跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
BankerToolBench
Agent
分享
官方网站
BankerToolBench 评估 AI Agent 执行投行分析师日常分析工作的能力。与 502 位顶级投行从业者合作开发,要求 Agent 操作数据室、市场数据平台和 SEC 数据库,生成 Excel 模型、PPT 和 PDF 报告。单任务耗时长达 21 小时。
排行
数据源
#
模型
得分
1
Claude Opus 4.7
Anthropic
81.3
%
2
MiniMax M3
MiniMax
76.1
%
3
GPT-5.5
OpenAI
70.0
%
4
Gemini 3.1 Pro
Google
67.0
%
5
MiniMax M2.7
MiniMax
63.9
%
共 5 个模型