arXiv endorsement request — cs.LG, causal study of latent reasoning + RL in chess
An independent researcher seeking an arXiv endorsement for cs.LG reports that a causal study of latent reasoning in a chess-playing LLM found that reinforcement learning (GRPO) improved legal-move rat…