Skip to main content
leaderboard
.cn
Toggle Sidebar
Search models or organizations…
⌘K
Explore
Frontier Models
Historical Trends
Local Models
Compare Models
Ranking Studio
Library
Models
Pricing
Organizations
Benchmarks
Data sources
Settings
Toggle Sidebar
leaderboard
.cn
Loading page content
Feedback
Benchmark details loading
Back to benchmarks
Terminal Bench 2.1 (Terminus-2)
Coding
Share
Official website
Results for 36 models collected from 11 public sources.
Ranking
Sources
#
Model
Score
1
Gemini 3.8 Flash
Google
89.4
%
2
Claude Opus 5
Anthropic
89.1
%
3
GPT-5.6 Sol
OpenAI
88.8
%
4
Claude Fable 5
Anthropic
88.0
%
5
GPT-5.6 Terra
OpenAI
87.4
%
6
Gemini 3.7 Flash
Google
85.8
%
7
Claude Opus 4.8
Anthropic
85.0
%
8
GPT-5.6 Luna
OpenAI
84.7
%
9
GPT-5.5
OpenAI
84.0
%
10
Grok 4.5
xAI
83.3
%
36 models total
1
2
3
4