跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
CharXiv(RQ)
多模态
分享
官方网站
CharXiv 是评估 AI 理解科学图表的基准,包含来自 arXiv 论文的数千张复杂科学图表。RQ 子集要求模型回答关于图表的具体推理问题,涵盖趋势分析、数值比较和数据解释等,测试模型在学术级图表上的视觉理解与定量推理能力。
排行
数据源
#
模型
得分
1
Claude Fable 5
Anthropic
88.9
%
2
Qwen3.8-Max
阿里巴巴
88.4
%
3
GPT-5.6 Terra
OpenAI
85.9
%
4
Qwen3.7-Plus
阿里巴巴
85.8
%
5
Gemini 3.6 Flash
Google
85.2
%
6
GPT-5.6 Sol
OpenAI
85.1
%
7
Kimi K3
月之暗面
84.8
%
8
Qwen3.8-Flash-Next
阿里巴巴
84.6
%
9
Gemini 3.7 Flash
Google
84.5
%
10
Gemini 3.1 Pro
Google
84.4
%
共 42 个模型
1
2
3
4
5