8.0
热点
AI SCORE
开源项目2026-08-10 14:23
Harvey开源法律Agent评测基准LAB:真实法律任务+量化评分
GitHub Trending#Agent#评测基准#法律AI
Editor brief · 编辑速览
专门评估LLM Agent处理真实法律任务能力的开源基准,包含并购数据室等多种现实场景任务、标准化评测流程和LLM评判机制。相比通用benchmark更贴近专业领域,可用于测试Agent在结构化专业文档处理上的表现。
专门评估LLM Agent处理真实法律任务能力的开源基准,包含并购数据室等多种现实场景任务、标准化评测流程和LLM评判机制。相比通用benchmark更贴近专业领域,可用于测试Agent在结构化专业文档处理上的表现。
这条资讯可作为技术选型和趋势判断的线索。使用前应阅读原始来源,并通过小规模验证确认成本、兼容性与维护风险。