SAGE: Surrogate-gradient Adaptation via Attention-Guided Entropy for Spiking Transformers
Researchers introduced SAGE, an uncertainty-modulated surrogate-gradient mechanism for Transformer-based spiking neural networks (SNNs), which adapts the surrogate-gradient slope during training using…