04:00
2026-08-27
machinebrief.com
large-language-models
Prefix Sliding for efficient test-time scaling
Researchers propose Prefix Sliding, a method that discards intermediate reasoning tokens during test-time scaling, capping memory use and enabling existing models to run 3x faster without training whi…