跳转至

👻 幻觉检测

🧠 NeurIPS2026 · 1 篇论文解读

📌 同领域跨会议浏览: 🎞️ ECCV2026 (20) · 📷 CVPR2026 (33) · 🔬 ICLR2026 (40) · 💬 ACL2026 (28) · 🧪 ICML2026 (21) · 🤖 AAAI2026 (15)

The Commit-Abstain Circuit: Why Language Models Hallucinate Instead of Abstaining

论文从生成前的作答—弃答 logit 间隔定位稀疏的作答—弃答电路(Commit-Abstain Circuit,CAC),发现早期作答积累与晚期弃答纠偏不足的模式,再用分量级贡献训练轻量策略,将报告的平均决策准确率从 0.692 提升至 0.814,而非证明答案内容准确率提高。