跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
CountQA
多模态
分享
CountQA 是视觉计数问答基准,以 VQA 形式要求模型回答图像中特定类别物体的数量。与 CountBench 相比更强调语言理解和计数能力的结合,覆盖更广泛的实际应用场景如人群计数、库存清点等。
排行
数据源
#
模型
得分
1
Qwen3.8-Max
阿里巴巴
82.4
%
2
Qwen3.7-Plus
阿里巴巴
77.0
%
3
Gemini 3.1 Pro
Google
72.8
%
4
Qwen3.6-Plus
阿里巴巴
71.7
%
5
GPT-5.6 Sol
OpenAI
68.6
%
6
Claude Fable 5
Anthropic
63.1
%
7
Claude Opus 4.8
Anthropic
41.3
%
8
Claude Opus 4.6
Anthropic
32.5
%
共 8 个模型