04:00
2026-07-15
arxiv.org
large-language-models
GRID: Grammar-Railed Decoding for Enterprise SQL Generation
GRID (Grammar-Railed Decoding), a grammar-constrained decoding engine for enterprise SQL generation, achieves a median per-token mask latency of 3.6-6.7 microseconds using Rust kernels, outperforming …