Skip to main content
leaderboard
.cn
Toggle Sidebar
Search models or organizations…
⌘K
Explore
Frontier Models
Historical Trends
Local Models
Compare Models
Ranking Studio
Library
Models
Pricing
Organizations
Benchmarks
Data sources
Settings
Toggle Sidebar
leaderboard
.cn
Loading page content
Feedback
Benchmark details loading
Back to benchmarks
MMLU-Pro
Reasoning
Share
Official website
An upgraded, harder MMLU with more than 12,000 questions
Ranking
Sources
#
Model
Score
1
Gemini 3.1 Pro
Google
91.0
%
2
Gemini 3 Pro
Google
90.1
%
3
Claude Opus 4.6
Anthropic
89.7
%
4
Qwen3.7-Max
Alibaba
89.6
%
5
Claude Opus 4.5
Anthropic
89.5
%
6
Qwen3.6-Plus
Alibaba
88.5
%
7
Qwen3.7-Plus
Alibaba
88.5
%
8
Qwen3.5-397B-A17B
Alibaba
88.3
%
9
Claude Sonnet 4.5
Anthropic
88.2
%
10
Kimi-K2.6
Moonshot AI
88.1
%
95 models total
1
2
3
4
5
…
More pages
10