04:00
2026-07-15
arxiv.org
machine-learning
When Does Reward Teach State? A Hidden-Automaton Instrument and the Group-Language Boundary
A new white-box instrument using hidden deterministic finite automata (DFA) reveals that high reward in reinforcement learning does not guarantee latent-state learning. Researchers at arXiv show that …