Skip to main content
leaderboard
.cn
Toggle Sidebar
Search models or organizations…
⌘K
Explore
Frontier Models
Historical Trends
Local Models
Compare Models
Ranking Studio
Library
Models
Pricing
Organizations
Benchmarks
Data sources
Settings
Toggle Sidebar
leaderboard
.cn
Loading page content
Feedback
Loading page content
Back to models
Claude Sonnet 5
Closed
Share
Add to comparison
Tool use · Reasoning
Overview
Pricing
Evaluations
Evaluation overview
Overall rank
#27
86.9 points · 202 models
Agents rank
#16
87.1 points · 148 models
Data coverage
40 items
11 sources · updated through 2026-09-02
Domain performance
Coding
#27 / 182
84.5
Research
#41 / 196
89.7
Agents
#16 / 148
87.1
Vision
#41 / 82
75.5
Long context
#19 / 95
85.4
Evaluation highlights
All evaluations
Arena Agent Steerability
Agents · Arena.ai Agent · High mode
12.29%
4
/ 52
Arena Text Rating
Reasoning · Arena.ai Text · Thinking mode
1,464.3Elo
38
/ 375
Arena Vision Rating
Multimodal · Arena.ai Vision · High mode
1,273.28Elo
21
/ 133
MLE-Bench (Partial 30)
Coding · Google Gemini 3.6 Flash Official Release Evaluation
66.9%
1
/ 6
Arena Document Rating
Long context · Arena.ai Document · Thinking mode
1,476.14Elo
11
/ 33
Arena Agent Praise vs Complaint
Agents · Arena.ai Agent · High mode
15.3%
7
/ 52
Basic information
Context (input / output)
1M / 128K
Release date
2026-06
Input modalities
Text · Image
Output modalities
Text
Reliable knowledge cutoff
2026-01
Training data cutoff
2026-04
Availability
Anthropic
Full pricing
Input
$2 /1M
Output
$10 /1M
Related links
Official site
Version relationships
Provider variants
Search
Runtime modes
High