跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
IFBench
推理
分享
官方网站
IFBench (Instruction Following Benchmark) 是一个综合性指令遵循评测基准,整合了 IFEval、FollowBench 等多个来源的指令遵循任务。采用宽松评分,接受部分符合指令要求的输出。
排行
数据源
#
模型
得分
1
Qwen3.8-2.4T-A95B
阿里巴巴
82.8
%
2
Qwen3.8-Max
阿里巴巴
82.8
%
3
Qwen3.8-Flash-Next
阿里巴巴
81.3
%
4
Qwen3.8-27B
阿里巴巴
79.5
%
5
DeepSeek-V4-Flash-0731
深度求索
79.2
%
6
Qwen3.7-Plus
阿里巴巴
79.1
%
7
Qwen3.7-Max
阿里巴巴
79.1
%
8
Muse Glimmer 30B
Meta
77.0
%
9
DeepSeek-V4-Pro
深度求索
77.0
%
10
Qwen3.5-397B-A17B
阿里巴巴
76.5
%
共 36 个模型
1
2
3
4