Skip to main content
leaderboard
.cn
Toggle Sidebar
Search models or organizations…
⌘K
Explore
Frontier Models
Historical Trends
Local Models
Compare Models
Ranking Studio
Library
Models
Pricing
Organizations
Benchmarks
Data sources
Settings
Toggle Sidebar
leaderboard
.cn
Loading page content
Feedback
Benchmark details loading
Back to benchmarks
OSWorld 2.0 Partial (w/o exec)
Agents
Share
Official website
Results for 17 models collected from 6 public sources.
Ranking
Sources
#
Model
Score
1
Claude Opus 5
Anthropic
75.4
%
2
Claude Fable 5
Anthropic
66.1
%
3
GPT-5.6 Sol
OpenAI
62.6
%
4
Gemini 3.8 Flash
Google
59.0
%
5
Claude Opus 4.8
Anthropic
54.8
%
6
Qwen3.8-Flash-Next
Alibaba
52.3
%
7
Gemini 3.7 Flash
Google
50.6
%
8
GPT-5.6 Terra
OpenAI
50.2
%
9
Qwen3.8-27B
Alibaba
48.0
%
10
GPT-5.5
OpenAI
47.5
%
17 models total
1
2