跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
MMStar
多模态
分享
官方网站
MMStar 是由上海 AI Lab 等提出的多模态评测基准,包含 1500 道精心设计的题目,覆盖感知、知识、逻辑推理等多个维度。每道题都有明确的答案和解释,使用准确率作为指标。题目设计注重去除数据泄露风险,确保公平评估。
排行
数据源
#
模型
得分
1
Qwen3.8-Max
阿里巴巴
85.9
%
2
Gemini 3.1 Pro
Google
84.0
%
3
Qwen3.5-397B-A17B
阿里巴巴
83.8
%
4
Qwen3.6-Plus
阿里巴巴
83.3
%
5
Qwen3.7-Plus
阿里巴巴
83.2
%
6
Gemini 3 Pro
Google
83.1
%
7
GPT-5.6 Sol
OpenAI
82.5
%
8
Qwen3.6-27B
阿里巴巴
81.4
%
9
Qwen3.6-35B-A3B
阿里巴巴
80.7
%
10
Claude Fable 5
Anthropic
80.5
%
共 14 个模型
1
2