跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
ScreenSpot Pro
多模态
分享
官方网站
ScreenSpot Pro 是屏幕截图理解基准的增强版,评测多模态模型对手机、桌面和网页截图中 UI 元素、文字和布局的感知能力。包含小控件识别、屏幕文字读取和界面布局理解等任务,用于 GUI 智能体和 UI 自动化领域的能力评估。
排行
数据源
#
模型
得分
1
Claude Fable 5
Anthropic · Claude Mythos 5 已按站内归并规则归入 Claude Fable 5。
87.3
%
2
Qwen3.8-Max
阿里巴巴
84.5
%
3
Claude Opus 4.8
Anthropic
82.3
%
4
GPT-5.6 Sol
OpenAI
81.3
%
5
Qwen3.7-Plus
阿里巴巴
79.0
%
6
Qwen3.6-27B
阿里巴巴
76.1
%
7
Gemma 4 31B
Google
75.9
%
8
Muse Glimmer 30B
Meta
75.4
%
9
Gemini 3 Pro
Google
72.7
%
10
Qwen3.6-Plus
阿里巴巴
68.2
%
共 14 个模型
1
2