04:00
2026-08-24
arxiv.org
large-language-models
Self-Speculation for Faster Reasoning Models
Researchers introduced SSR (Self-Speculation for Reasoning Models), a training-free self-speculative decoding method that uses partial chain-of-thought as a drafter and full chain-of-thought as a veriβ¦