跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
Kimi Code Bench v2
编程
分享
Moonshot AI 内部编程 Agent 基准,覆盖 10+ 主流语言和真实软件工程任务。
Kimi Code Bench v2 是 Moonshot AI 内部编程 Agent 评测,覆盖 10 多种主流编程语言和完整生产技术栈。任务来源包括内部工程场景、生产事故和真实开源项目,重点考察后端服务、基础设施、性能工程、系统编程、安全、前端开发和 ML/Data 工程能力。
排行
数据源
#
模型
得分
1
Claude Fable 5
Anthropic
76.9
%
2
Kimi K3
月之暗面
72.9
%
3
Claude Opus 4.8
Anthropic
71.7
%
4
GPT-5.5
OpenAI
69.0
%
5
GPT-5.6 Sol
OpenAI
64.8
%
6
GLM-5.2
智谱AI
64.2
%
7
Kimi-K2.7-Code
月之暗面
62.0
%
8
Kimi-K2.6
月之暗面
50.9
%
共 8 个模型