跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
SWE-fficiency
编程
分享
官方网站
SWE-fficiency 聚焦 AI 编程的效率维度,评估模型以最少的步骤、编辑次数和 token 消耗解决 SWE 任务的能力。与传统的仅看解决率不同,该基准衡量修复 bug 的「性价比」,鼓励更精准的代码修改。
排行
数据源
#
模型
得分
1
GPT-5.5
OpenAI
46.6
%
2
Claude Opus 4.7
Anthropic
42.2
%
3
MiniMax M3
MiniMax
34.8
%
4
Gemini 3.1 Pro
Google
19.7
%
5
MiniMax M2.7
MiniMax
14.0
%
共 5 个模型