Skip to main content
leaderboard
.cn
Toggle Sidebar
Search models or organizations…
⌘K
Explore
Frontier Models
Historical Trends
Local Models
Compare Models
Ranking Studio
Library
Models
Pricing
Organizations
Benchmarks
Data sources
Settings
Toggle Sidebar
leaderboard
.cn
Loading page content
Feedback
Benchmark details loading
Back to benchmarks
Terminal-Bench 2.1
Agents
Share
Results for 14 models collected from 5 public sources.
Ranking
Sources
#
Model
Score
1
GPT-5.6 Sol
OpenAI
88.8
%
2
GPT-5.6 Terra
OpenAI
87.4
%
3
GPT-5.5
OpenAI
85.6
%
4
GPT-5.6 Luna
OpenAI
84.7
%
5
Claude Fable 5
Anthropic
84.3
%
6
Grok 4.5
xAI
83.3
%
7
Claude Opus 4.8
Anthropic
82.7
%
8
Muse Spark 1.1
Meta
80.0
%
9
Claude Opus 4.7
Anthropic
78.9
%
10
Seed2.1 Pro
ByteDance
71.0
%
14 models total
1
2