16:14
2026-09-02
frontierharness.org
ai-research
Show HN: FrontierHarness Eval โ 9 harness, same model, cost per pass varies 17x
FrontierHarness Eval, a new benchmark from Runta, tested nine AI coding harnesses on the same model and found median cost per successful task varies by 17x, with Claude Code v2.1.237 passing 19 tasks โฆ