Skip to main content
leaderboard
.cn
Toggle Sidebar
Search models or organizations…
⌘K
Explore
Frontier Models
Historical Trends
Local Models
Compare Models
Ranking Studio
Library
Models
Pricing
Organizations
Benchmarks
Data sources
Settings
Toggle Sidebar
leaderboard
.cn
Loading page content
Feedback
Benchmark details loading
Back to benchmarks
SWE-Marathon
Coding
Share
Official website
Results for 10 models collected from 3 public sources.
Ranking
Sources
#
Model
Score
1
Kimi K3
Moonshot AI
42.0
%
2
Claude Opus 4.8
Anthropic
40.0
%
3
GPT-5.6 Sol
OpenAI
39.0
%
4
Claude Fable 5
Anthropic
35.0
%
5
Grok 4.5
xAI
29.0
%
6
Claude Opus 4.7
Anthropic
16.0
%
7
GPT-5.5
OpenAI
14.0
%
8
GLM-5.2
Zhipu AI
13.0
%
9
Gemini 3.1 Pro
Google
4.0
%
10
GLM-5.1
Zhipu AI
1.0
%
10 models total