Skip to main content
leaderboard
.cn
Toggle Sidebar
Search models or organizations…
⌘K
Explore
Frontier Models
Historical Trends
Local Models
Compare Models
Ranking Studio
Library
Models
Pricing
Organizations
Benchmarks
Data sources
Settings
Toggle Sidebar
leaderboard
.cn
Loading page content
Feedback
Benchmark details loading
Back to benchmarks
MCPMark-Verified
Agents
Share
Official website
Results for 7 models collected from 2 public sources.
Ranking
Sources
#
Model
Score
1
Kimi K3
Moonshot AI
94.5
%
2
GPT-5.6 Sol
OpenAI
92.9
%
3
GPT-5.5
OpenAI
92.9
%
4
Claude Fable 5
Anthropic
87.4
%
5
Kimi-K2.7-Code
Moonshot AI
81.1
%
6
Claude Opus 4.8
Anthropic
76.4
%
7
Kimi-K2.6
Moonshot AI
72.8
%
7 models total