Skip to main content
leaderboard
.cn
Toggle Sidebar
Search models or organizations…
⌘K
Explore
Frontier Models
Historical Trends
Local Models
Compare Models
Ranking Studio
Library
Models
Pricing
Organizations
Benchmarks
Data sources
Settings
Toggle Sidebar
leaderboard
.cn
Loading page content
Feedback
Benchmark details loading
Back to benchmarks
Tool-Decathlon
Agents
Share
Official website
Results for 21 models collected from 8 public sources.
Ranking
Sources
#
Model
Score
1
Claude Opus 4.8
Anthropic
59.9
%
2
GPT-5.5
OpenAI
55.6
%
3
GPT-5.4
OpenAI
54.6
%
4
DeepSeek-V4-Pro
DeepSeek
52.8
%
5
Kimi-K2.6
Moonshot AI
50.0
%
6
Gemini 3.1 Pro
Google
48.8
%
7
GLM-5.2
Zhipu AI
48.2
%
8
Claude Opus 4.6
Anthropic
47.2
%
9
MiniMax M2.7
MiniMax
46.3
%
10
GPT-5.2
OpenAI
46.3
%
21 models total
1
2
3