04:00
2026-08-17
arxiv.org
artificial-intelligence
Batch-wise Adaptive Pruning: Periodic Neuron Activation-Aware Weight Pruning for Language Reasoning Model
Researchers propose Batch-wise Adaptive Pruning, a training-free method for batched inference in Large Reasoning Models (LRMs), achieving a 39.7 percentage point average accuracy improvement over prioβ¦