04:00
2026-07-24
arxiv.org
artificial-intelligence
InferenceBench: A Benchmark for Open-Ended LLM Inference Optimization by AI Agents
Researchers introduced InferenceBench, a benchmark where AI agents must optimize LLM inference speed on an H100 GPU within two hours, finding that agents improved up to 8.08ร over a naive baseline butโฆ