跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
PostTrainBench v1.1
编程
Agent
分享
官方网站
PostTrainBench v1.1 评估模型执行后训练任务的能力,使用 OpenCode、单张 NVIDIA H100 和 10 小时预算,按四个基座模型和七项基准加权汇总。
排行
数据源
#
模型
得分
1
Claude Opus 5.5
Anthropic
49.3
%
2
Gemini 4 Argon
Google
45.3
%
3
GPT-6 Astra
OpenAI
44.3
%
4
Claude Fable 5.1
Anthropic
40.2
%
共 4 个模型