合同审核 Agent 测试包
包含《法律 AI 监测 No.01》公开报告,以及市场推广、猎头采购和客户运营外包三份脱敏合同样本。
下载公开测试包WorkBuddy、Claude、Codex、豆包、千问和 DeepSeek 共完成 18 次运行。每组都要读取原始 DOCX、调用相同范围的工具与资料,并在原文中留下 Word 原生修订和批注。
直播分数描述任务理解、工具使用、风险识别与 Word 可用性;法律放行还要单独检查立场、事实、关键风险、论证、条款闭环和人工责任节点。
18 份 Word 只代表当时锁定任务、版本与权限下的表现,不是产品长期排名。一个关键问题未闭环,不能由其他维度的高分抵销。
公开测试包包含本期公开报告和三份虚构、脱敏的合同样本。你可以先让自己的 Agent 独立完成,再检查它是否站对立场、区分事实与假设、处理关键风险并把方案真正写进合同。
包含《法律 AI 监测 No.01》公开报告,以及市场推广、猎头采购和客户运营外包三份脱敏合同样本。
下载公开测试包把 Agent 结果放回具体任务后,再浏览已完成独立测评的 Skill,比较适用场景、优势、许可与边界。
查看推荐 Skill沿用同三份合同,把变量从六款 Agent 切换为五个开源合同审核 Skill,并加入不加载 Skill 的基础组。
进入 Skill 横评资料页本场把法律人的 AI 使用方式拆成四层。它们不是职位等级,也不要求每个人都写代码;差别在于一次答案能否逐步变成可重复、可验证的组织能力。
AI 可以帮助读取、比对、检索、起草和记录;业务人员仍要确认真实交易事实与目标,法务或律师仍要承担法律定性、风险排序、谈判取舍与最终签发。
真正可迁移的竞争力,是持续理解变化、把输出变成可靠交付,再把一次成功沉淀为 Workflow、Skill、检查标准或团队规则。
本页材料仅用于学习、研究与工具评测,不构成针对具体事项的法律意见,也不替代律师或法务的专业复核。