跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
LiveCodeBench (2407-2501)
推理
分享
官方网站
代码生成基准, 2024.07-2025.01 题目
LiveCodeBench 由 Princeton 等机构于 2024 年提出,提供从 LeetCode、AtCoder、CodeForces 持续收集的新题,用于无污染评估 LLM 代码能力。支持代码生成、自修复、代码执行和测试输出预测四种场景,使用 pass@1 指标。截至目前包含 1055 道题(v6)。
排行
数据源
#
模型
得分
1
Gemini 2.5 Pro
Google
80.1
%
2
GLM-4.5
智谱AI
72.9
%
3
GLM-4.5-Air
智谱AI
70.7
%
4
DeepSeek-R1-Distill-Llama-70B
深度求索
57.5
%
5
DeepSeek-R1-Distill-Qwen-32B
深度求索
57.2
%
6
OpenAI o1-mini
OpenAI
53.8
%
7
DeepSeek-R1-Distill-Qwen-14B
深度求索
53.1
%
8
QwQ-32B-Preview
阿里巴巴
41.9
%
9
DeepSeek-R1-Distill-Llama-8B
深度求索
39.6
%
10
Claude 3.5 Sonnet 20241022
Anthropic
38.9
%
共 18 个模型
1
2