Skip to main content
leaderboard
.cn
Toggle Sidebar
Search models or organizations…
⌘K
Explore
Frontier Models
Historical Trends
Local Models
Compare Models
Ranking Studio
Library
Models
Pricing
Organizations
Benchmarks
Data sources
Settings
Toggle Sidebar
leaderboard
.cn
Loading page content
Feedback
Benchmark details loading
Back to benchmarks
HLE (Humanity's Last Exam)
Reasoning
Share
Official website
Results for 57 models collected from 22 public sources.
Ranking
Sources
#
Model
Score
1
Claude Opus 4.8
Anthropic
49.8
%
2
GPT-5.5
OpenAI
46.9
%
3
Claude Opus 4.7
Anthropic
46.9
%
4
Gemini 3.1 Pro
Google
45.0
%
5
GPT-5.5 Pro
OpenAI
43.1
%
6
GPT-5.4 Pro
OpenAI
42.7
%
7
Qwen3.7-Max
Alibaba
41.4
%
8
GLM-5.2
Zhipu AI
40.5
%
9
Claude Opus 4.6
Anthropic
40.0
%
10
GPT-5.4
OpenAI
39.8
%
57 models total
1
2
3
4
5
6