04:00
2026-07-16
arxiv.org
large-language-models
Uncertainty-Aware Sequential Decision Rules for Event-Triggered LLM Invocation in Streaming Systems
A new arXiv preprint (2607.13048v1) formalizes when to invoke large language models (LLMs) in streaming inference systems as a risk-based sequential stopping problem, proving six theoretical results iā¦