Compare Models

Evaluate leading AI models side-by-side. Compare context windows, open-weights licensing, parameters, and verified benchmarks to choose the right model for your application.

Comparing 1 of 4 models
Model Comparison Matrix
Add a model
Add a model
Add a model
TypeAPI Only
Release DateJul 9, 2026
LicenseProprietary
Parametersundisclosed
Modalities
textimagepdf
Context Window1.1M tokens
Primary Taskchat reasoning
Release Date2026-07-09
Agents' Last Exam
52.7 (score)
Artificial Analysis Coding Agent Index
80 (index score)
Artificial Analysis Intelligence Index
58.9 (index score)
BrowseComp
90.4 (accuracy)
DeepSWE
72.7 (resolve rate)
FrontierMath
89 (accuracy)
GPQA Diamond
94.6 (accuracy)
MMMU Pro
83 (accuracy)
OSWorld
62.6%
SWE-Bench Pro
64.6 (resolve rate)
Terminal-Bench
88.8%
Toolathlon
58%