{"type": "article", "title": "HeadWiseKV: Budgeted Per-Head Cache Residency for Hybrid Long-Context Language Models", "publisher": "Web Pulse", "url": "https://wpnews.pro/news/headwisekv-budgeted-per-head-cache-residency-for-hybrid-long-context-language", "original_source": "https://arxiv.org/abs/2609.02029", "published": "2026-09-03T04:00:00+00:00", "accessed": "2026-09-03", "id": "headwisekv-budgeted-per-head-cache-residency-for-hybrid-long-context-language"}