04:00
2026-09-17
arxiv.org
large-language-models
The Missing "I Don't Know": Why Three Reasoning-Reliability Findings Converge on Calibrated Abstention
A new arXiv paper (2609.17686v1) argues that three separate LLM reliability findings converge on calibrated abstention as the missing capability, citing Yin et al. (2026) on reasoning RL collapsing toβ¦