Skip to main content
leaderboard
.cn
Toggle Sidebar
Search models or organizations…
⌘K
Explore
Frontier Models
Historical Trends
Local Models
Compare Models
Ranking Studio
Library
Models
Pricing
Organizations
Benchmarks
Data sources
Settings
Toggle Sidebar
leaderboard
.cn
Loading page content
Feedback
Benchmark details loading
Back to benchmarks
Terminal-Bench 2.1
Agents
Share
Results for 30 models collected from 13 public sources.
Ranking
Sources
#
Model
Score
1
GPT-5.6 Sol
OpenAI · max mode
88.8
%
2
Muse Spark 1.3
Meta · max mode
88.8
%
3
Kimi K3
Moonshot AI
88.3
%
4
GLM-5.3
Zhipu AI
88.2
%
5
Claude Fable 5
Anthropic
88.0
%
6
DeepSeek-V4-Pro-0813
DeepSeek
87.9
%
7
GPT-5.6 Terra
OpenAI
87.4
%
8
Claude Opus 5
Anthropic · max mode
86.7
%
9
Qwen3.8-Max
Alibaba
86.6
%
10
Gemini 3.7 Flash
Google
85.8
%
30 models total
1
2
3