model profile
Rank · overall#1
Score96.4
Benchmark scores
12 benchmarksSWE-bench Verified95%% Resolved · 2026-06-09
Terminal-Bench 2.183.8%Accuracy · Jun 7, 2026 · ± 1.2
ixio runs100%Pass rate · 2026-07-09
Chatbot Arena (Coding)1566Coding Elo
Artificial Analysis59.9Intelligence Index
AA Coding Index76.5Coding Index
ARC-AGI86%Score
Arena Agent12.72%Net Improvement · ± 2
WebDev Arena1634WebDev Elo · ± 12
FrontierMath (Tier 4)87.8%Accuracy · ± 5.2
MCP Atlas83.3Score
BrowseComp88%Accuracy
Across harnesses
3 agentsClaude CodeCLI
—83.8%100%—————————
100mini-SWE-agentAgent
——100%—————————
100Terminus 2Agent
—80.4%——————————
88Per-benchmark score · composite per harness. Tap a row to open that board.
Scraped and aggregated from public leaderboards · 2026-07-22