跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
TIR-Bench
多模态
推理
分享
TIR-Bench (Text-Image Reasoning Benchmark) 是文本图像综合推理评测,要求模型同时理解图片中的视觉元素和叠加文本信息并跨模态推理。涵盖广告海报解读、图文混合的新闻理解等场景,评估多模态融合推理能力。
排行
数据源
#
模型
得分
1
Qwen3.5-397B-A17B
阿里巴巴
62.5
%
2
Qwen3.6-Plus
阿里巴巴
61.6
%
3
Gemini 3 Pro
Google
47.5
%
4
Claude Opus 4.5
Anthropic
32.3
%
5
Kimi-K2.5
月之暗面
29.2
%
共 5 个模型