Compare Models

Evaluate leading AI models side-by-side. Compare context windows, open-weights licensing, parameters, and verified benchmarks to choose the right model for your application.

Comparing 1 of 4 models
Model Comparison Matrix
Add a model
Add a model
Add a model
TypeAPI Only
Release DateJul 9, 2026
LicenseProprietary
Parametersundisclosed
Modalities
textimagepdf
Context Window1.1M tokens
Primary Taskchat reasoning
Release Date2026-07-09
Agents' Last Exam
50.4 (score)
Artificial Analysis Coding Agent Index
77.4 (index score)
Artificial Analysis Intelligence Index
55 (index score)
BrowseComp
87.5 (accuracy)
DeepSWE
69.6 (resolve rate)
FrontierMath
84.9 (accuracy)
GPQA Diamond
92.9 (accuracy)
MMMU Pro
80.7 (accuracy)
OSWorld
50.2%
SWE-Bench Pro
63.4 (resolve rate)
Terminal-Bench
87.4%
Toolathlon
53.1%