跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
LABBench 2
推理
分享
生物学实际科研任务;模型可使用预装生信工具、Python、R 的 Linux 终端及受限制互联网访问。
LABBench 2 评估 AI Agent 在真实生物学科研任务上的能力。模型在预装生信工具、Python 与 R 的 Linux 终端中工作,可访问受限互联网,完成数据处理、分析与假设验证等端到端科研流程。
排行
数据源
#
模型
得分
1
Gemini 3.7 Flash
Google
82.1
%
2
GPT-5.6 Terra
OpenAI
81.2
%
3
Claude Sonnet 5
Anthropic
80.1
%
4
Gemini 3.6 Flash
Google
76.1
%
共 4 个模型