12:56
2026-08-13
deepswe.datacurve.ai
artificial-intelligence
Grok 4.6 /medium outperforms /high effort on DeepSWE
DeepSWE, a new long-horizon software engineering benchmark, reports that Grok 4.6 /medium outperforms /high effort on its leaderboard, which measures frontier coding agents on original tasks across 91โฆ