04:00
2026-09-12
arxiv.org
machine-learning
Fork Where the Model Changes Its Mind: Belief-Shift Branching for Tree-Structured Reinforcement Learning
A new arXiv paper (2609.11061v1) proposes belief-shift branching, a fork-placement method for tree-structured reinforcement learning with verifiable rewards that forks a chain just before the step wheβ¦