跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
PinchBench
Agent
分享
PinchBench 评估 AI Agent 在移动端或触控界面上的精细操作能力。测试 Agent 对缩放、拖动、长按等触控手势的理解和执行,以及在这些交互模式下完成特定任务的能力,是面向移动端 Agent 的专项评估基准。
排行
数据源
#
模型
得分
1
DeepSeek-V4-Flash
深度求索
91.3
%
2
Kimi-K2.6
月之暗面
90.2
%
3
Nemotron-3-Ultra
NVIDIA
90.0
%
4
DeepSeek-V4-Pro
深度求索
88.6
%
5
Qwen3.5-397B-A17B
阿里巴巴
86.6
%
6
Nemotron 3.5 Lightning
NVIDIA
83.4
%
7
GLM-5.1
智谱AI
81.2
%
8
MiniMax M2.7
MiniMax
77.6
%
共 8 个模型