21:51
2026-07-15
github.com
machine-learning
Sokoban Speedrun for RL
A new speedrun benchmark for training reinforcement learning agents to solve Sokoban puzzles has been released, with two tracks: an LLM track fine-tuning Qwen3-4B-Instruct-2507 on 8xH100 GPUs to achieβ¦