Lexical Prompt Compression for Large Language Models: A Training-Free, Deterministic Pipeline with Empirical Pareto Analysis Across Eleven Task Categories
A training-free, CPU-only lexical prompt-compression pipeline reduced prompt tokens by a mean of 40.3% (sigma = 9.2) while holding BERTScore-F1 at 0.876 against original-prompt output, according to an arXiv paper (2609.1…