InferenceBench: A Benchmark for Open-Ended LLM Inference Optimization by AI Agents
Researchers introduced InferenceBench, a benchmark where AI agents must optimize LLM inference speed on an H100 GPU within two hours, finding that agents improved up to 8.08× over a naive baseline but…