06:07
2026-08-04
arxiv.org
large-language-models
Knowing When to Quit: Diagnosing and Training LLMs to Abort Futile Reasoning
Researchers introduced CaRL (Capability-aligned Reinforcement Learning), a method that trains large language models to refuse futile reasoning on tasks beyond their capability, reducing computationall…