Harvey's Legal Agent Benchmark(HLAB)考察智能体能否借助文档、表格、演示文稿与文件系统工具完成真实的法律工作,由 Harvey AI 构建、在 Vals AI 榜单上公布。⚠️ 口径提醒:本条目收录的是 HLAB 智能体版的整体通过率,分数普遍很低(个位数);Artificial Analysis 对 Harvey LAB 的独立复跑按评分要点通过率计分,数值高一个量级,单列在站内「Harvey Lab-AA」条目下,两者不可直接互比。
查看 Harvey's Legal Agent Benchmark 的最新得分、模型模式、发布时间与参数规模,快速了解当前完整榜单表现。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
| 排名 | 模型 | 开源情况 | |||
|---|---|---|---|---|---|
— | ![]() Claude Opus 5.5 思考水平·Max工具 | 3.75 | 2026-09-22 | 未知 | 闭源 |
— | ![]() GPT-6 Luna 思考水平·Max工具 | 2.92 | 2026-09-22 | 未知 | 闭源 |
— | ![]() GPT-6 Sol 思考水平·Max工具 | 1.67 | 2026-09-22 | 未知 | 闭源 |