跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
BabyVision
多模态
分享
BabyVision 是一组受婴儿认知发展研究启发的视觉理解评测集,包含多个子任务测试模型的物理直觉、物体持久性和基础因果推理能力。通过模拟婴儿认知实验(如期望违背范式)来评估 AI 是否具备类似人类婴儿的视觉世界理解能力。
排行
数据源
#
模型
得分
1
Qwen3.8-Max
阿里巴巴
82.0
%
2
Seed2.1 Pro
字节跳动
73.7
%
3
Gemini 3.7 Flash
Google
70.9
%
4
Qwen3.8-27B
阿里巴巴
65.7
%
5
GPT-5.6 Sol
OpenAI
65.5
%
6
Qwen3.7-Plus
阿里巴巴
64.7
%
7
Seed2.1 Turbo
字节跳动
62.9
%
8
GPT-5.6 Terra
OpenAI
61.6
%
9
Gemini 3.1 Pro
Google
55.9
%
10
GPT-5.5
OpenAI
55.9
%
共 20 个模型
1
2