Leaderboard

Compare AI models across standardized evals.

Model
Parameters
MMLU
HumanEval
MATH
405B88.6%--
2
UNDISCLOSED88.5-84.0
3
APPROX. 270B MOE87.5%--
550B86.8 (accuracy)--
550B TOTAL / 55B ACTIVE86.8%-97.0%
6
27B86.1-71.2
72.7B86.1%86.6%83.1%
35B85.3-64.4
9
Phi-4
Microsoft
14B82.7%--
30B78.3--
11
Mixtral 8x22B
Mistral AI
8X22B MOE (~39B ACTIVE)77.75%--
12
Bonsai 27B
PrismML
27B-86.0 (Ternary)-
13
UNDISCLOSED--89 (accuracy)
14
UNDISCLOSED--78.6 (accuracy)
UNDISCLOSED--84.9 (accuracy)
30B (3B ACTIVE)-50.0%-
17
UNDISCLOSED--52.4 (accuracy)
18
UNDISCLOSED--50 (accuracy)
17B (16-EXPERTS MOE)--65.2%
32.5B-92.7%-
236B MOE (21B ACTIVE)-90.2%-
22
Codestral 22B
Mistral AI
22B-81.1%-