04:00
2026-08-27
arxiv.org
artificial-intelligence
From Memorization to Absorption: Mixed-Policy RL for Continual Knowledge Injection
Researchers propose Golden-GRPO Injection (GRIN), a three-stage mixed-policy reinforcement learning framework for continual knowledge injection in large language models, which outperforms supervised fâŚ