跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
MultiPL-E
编程
分享
汇总 3 个公开数据来源和 31 个模型成绩。
排行
数据源
#
模型
得分
1
Qwen3-235B-A22B-Instruct-2507
阿里巴巴
87.9
%
2
Qwen3-30B-A3B-Instruct-2507
阿里巴巴
83.8
%
3
Qwen3-4B-Instruct-2507
阿里巴巴
76.8
%
4
GPT-4.1 nano 2025-04-14
OpenAI
76.3
%
5
Qwen3-30B-A3B
阿里巴巴 · 2025-04 初始模型的非思考模式
74.6
%
6
Qwen3-32B-Base
阿里巴巴
67.1
%
7
Qwen3-4B
阿里巴巴 · 2025-04 初始模型的非思考模式
66.6
%
8
Qwen3-30B-A3B-Base
阿里巴巴
66.5
%
9
Qwen3-235B-A22B-Base
阿里巴巴
65.9
%
10
DeepSeek-V3 Base
深度求索
62.3
%
共 31 个模型
1
2
3
4