跳到主内容
知行录
leaderboard.cn
Toggle Sidebar
搜索模型或厂商…
⌘K
分析
前沿模型
历史趋势
本地模型
模型对比
榜单工坊
资料库
模型库
模型价格
厂商
基准评测
数据源
设置
Toggle Sidebar
知行录
leaderboard.cn
正在加载页面内容
反馈
基准详情正在加载
返回基准目录
Legal Agent Benchmark
Agent
分享
Legal Agent Benchmark 评估 AI Agent 在法律专业场景中的任务执行能力。包括法律文书起草、案例检索、合同审查和法律分析等典型法律工作流,需要 Agent 理解法律概念、遵循法律程序并生成符合专业标准的输出。
排行
数据源
#
模型
得分
1
Claude Fable 5
Anthropic
13.3
%
2
Claude Opus 5
Anthropic
11.7
%
3
Claude Opus 4.8
Anthropic
10.4
%
4
GPT-5.6 Sol
OpenAI
2.5
%
5
GPT-5.5
OpenAI
2.1
%
6
Gemini 3.1 Pro
Google
0.0
%
共 6 个模型