SabaPivot's picture
Upgrade all claim evidence using high-scoring peer protocols with attribution
c27e2ab verified
Raw History Blame Contribute Delete
3.16 kB
{
"schema_version": 1,
"title": "Reproduction: Differentiable Conformal Training for LLM Reasoning Factuality",
"emoji": "🧭",
"space_id": "SabaPivot/repro-differentiable-conformal-training-for-llm-reasoning-factuality",
"paper": {
"arxiv_id": "2604.20098"
},
"tags": [
"icml2026-repro",
"paper-XfndtVLIub"
],
"updated_at": "2026-07-29T02:13:39Z",
"root": {
"slug": "index",
"title": "Reproduction: Differentiable Conformal Training for LLM Reasoning Factuality",
"file": "pages/index.md",
"children": [
{
"slug": "executive-summary",
"title": "Executive summary",
"file": "pages/executive-summary/page.md",
"children": []
},
{
"slug": "claim-1-math-retention",
"title": "Claim 1: Differentiable Coherent Factuality (DCF) achieves up to a 141% improvement in claim retention over frequency-based baselines on the MATH dataset at reliability level α=0.03 (1.76 vs. 0.73 claims retained) (Section 4.3).",
"file": "pages/claim-1-math-retention/page.md",
"children": []
},
{
"slug": "claim-2-felm-retention",
"title": "Claim 2: DCF achieves up to a 61% improvement in claim retention over frequency-based baselines on the FELM dataset at α=0.01 (Section 4.3).",
"file": "pages/claim-2-felm-retention/page.md",
"children": []
},
{
"slug": "claim-3-calibration-convergence",
"title": "Claim 3: Theorem 3.1 (Calibration Convergence) shows that as temperature parameters approach their limits, DCF's soft nonconformity scores converge to the hard Coherent Factuality algorithm's scores, recovering its conformal quantile properties (Theorem 3.1).",
"file": "pages/claim-3-calibration-convergence/page.md",
"children": []
},
{
"slug": "claim-4-prediction-convergence",
"title": "Claim 4: Theorem 3.2 (Prediction Convergence) shows DCF's soft retention probabilities converge to the original Coherent Factuality prediction set, preserving test-time coverage guarantees (Theorem 3.2).",
"file": "pages/claim-4-prediction-convergence/page.md",
"children": []
},
{
"slug": "claim-5-soft-hard-agreement",
"title": "Claim 5: DCF's soft relaxations achieve 90-100% agreement with hard Coherent Factuality predictions across α∈[0.01, 0.10], validating the smooth approximation (Section 4.2).",
"file": "pages/claim-5-soft-hard-agreement/page.md",
"children": []
},
{
"slug": "claim-6-joint-relaxation",
"title": "Claim 6: DCF jointly relaxes claim scoring together with logical-ancestor coherence enforcement and constrained argmax selection, rather than treating these graph operations independently (Section 3.2-3.4).",
"file": "pages/claim-6-joint-relaxation/page.md",
"children": []
},
{
"slug": "conclusion",
"title": "Conclusion",
"file": "pages/conclusion/page.md",
"children": []
}
]
},
"agent_view_tokens": 5000,
"revision": "1785148200000000000"
}