跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
OfficeQA Pro
Agent
分享
官方网站
OfficeQA Pro 评估 AI Agent 对办公文档的深度理解与问答能力。基于真实文档的接地问答基准,测试 Agent 从长文档中定位、提取和综合信息的能力,以答案导向的方式评分,关注最终答案的正确性。
排行
数据源
#
模型
得分
1
Claude Fable 5
Anthropic
69.9
%
2
Claude Opus 4.8
Anthropic
63.9
%
3
Kimi K3
月之暗面
63.3
%
4
GPT-5.6 Sol
OpenAI
63.2
%
5
GLM-5.3-Flash
智谱AI
62.4
%
6
GPT-5.5
OpenAI
60.9
%
7
DeepSeek-V4-Flash-Vision-Exp
深度求索
57.9
%
8
GPT-5.4
OpenAI
53.2
%
9
MiniMax M3
MiniMax
45.1
%
10
Claude Opus 4.7
Anthropic
43.6
%
共 12 个模型
1
2