OpenAI 携手 Ironclad:用 Computer Use 智能体重塑企业法务合同审查

Published · AI Daily — AI-assisted deep research, methodology & disclosure

OpenAI 与合同生命周期管理平台 Ironclad 宣布合作,把前沿智能体模型与 Computer Use 技术引入企业法务。智能体可在浏览器中操作法务库,对照企业条款手册核查条款,并自动完成修订标注与合规任务。公告称,该方案结合 Computer Use 与深度 API 集成,连接传统 ERP/CRM 系统,将常规合同审查周期缩短 70% 以上,同时保留确定性的人工复核与审计能力。

发布了什么

OpenAI 与合同生命周期管理(CLM)平台 Ironclad 宣布建立合作关系,把前沿的智能体模型与 Computer Use 技术直接交到企业法务团队手中。Ironclad 是一家专注合同全流程管理的软件公司。按照公告的说法,Ironclad 接入了 OpenAI 的智能体模型,让智能体能够在浏览器里操作法务资料库,把合同条款与企业自己的条款手册(playbook)逐项对照,并自主完成修订标注(redlining)和合规检查这类复杂任务。

公告还给出了几项关键说法:系统把 Computer Use 的基础能力与深度 API 集成结合起来,用自主推理把传统的 ERP、CRM 软件连接起来;常规合同审查周期缩短了 70% 以上;同时保持确定性的人工在环与可审计性。需要说明的是,以上信息均来自公告本身,本文没有独立核实这些数字。

技术机制:界面层与接口层并用

Computer Use 的核心思路,是让模型看到屏幕截图,再输出点击、输入、滚动等操作,像一名员工那样使用软件。它的好处是不依赖对方开放接口。企业里大量系统建于多年以前,接口残缺,甚至没有接口,法务人员平时就是在这些系统之间来回切换、复制粘贴。Computer Use 正好覆盖这块「最后一公里」。

但界面操作有天然的弱点:速度慢,对页面改版敏感,出错时难以回放。公告强调的是混合路径,即 Computer Use 与深度 API 集成并行。一个合理的理解是:能走接口的环节走接口,读取合同、写回状态这类动作更快、更稳、更容易留痕;只有接口覆盖不到的环节,才由智能体操作界面。这种分层设计把不确定性压缩到少数步骤,也方便在出问题时定位责任。

在推理层面,智能体要完成的不是单次问答,而是一条多步任务链:定位合同,读取全文,识别条款类型,对照条款手册判断是否偏离,生成修改建议,并记录依据。条款手册是企业法务多年谈判经验的沉淀,规定了哪些条款可以接受、哪些需要升级审批、哪些必须改写。把手册作为判断基准,意味着输出不是模型的自由发挥,而是在企业既定规则内的执行。公告没有披露具体使用了哪个模型、如何编排步骤,这些细节需要等官方进一步说明。

人工在环与可审计性

法务是对错误容忍度极低的领域。一条被漏掉的责任限制条款,可能在数年后带来巨额损失。因此公告特别强调保持确定性的人工在环与可审计性。一般而言,这类设计包含三层含义:其一,智能体的建议不会绕过律师直接生效,关键节点需要人批准;其二,每一步操作、每条引用的手册条目都有记录,可事后复盘;其三,同样的输入在同样的规则下应得到可预期的结果,而不是每次都不一样。

这里的「确定性」值得多想一步。大模型本身是概率性的,要让整体流程表现得确定,通常要靠流程设计来补:把判断依据固定为企业手册,把动作限定在预设范围,把输出格式结构化,再用规则校验兜底。公告摘要没有说明 Ironclad 具体采用了哪些手段,企业采购时应当主动追问。

公告没有披露的内容

阅读这类公告,要分清「说了什么」和「没说什么」。

从现有信息看,至少有几项缺口:70% 的缩短幅度,没有给出样本规模、合同类型和基线定义,也没有说明是否把人工复核时间算在内;没有给出准确率、漏检率等质量指标;没有披露价格、部署方式和数据处理条款;也没有讲清楚遇到界面变化或登录异常时,系统如何降级。在这些信息补齐之前,70% 更适合当作方向性信号,而不是可以写进预算的数字。

对开发者、企业与行业的意义

对开发者而言,这个案例说明智能体应用正在从通用演示走向垂直场景。真正的工程难点不在模型能不能点按钮,而在如何把模型接入企业已有的权限、日志和审批体系。会同时设计好接口层、界面层和人工审核层的团队,会比只做单点能力的团队更有优势。

对企业法务而言,最现实的价值是把律师从重复劳动里解放出来:常规的保密协议、采购合同、续约条款,由智能体先做第一轮审阅和标注,律师集中精力处理例外与谈判。但前提是企业已经把自己的条款手册整理成清晰、可执行的规则。手册本身含糊,智能体只会把含糊放大。

对行业而言,这是 Computer Use 进入高合规领域的一次公开尝试。法务既要准确,又要留痕,如果这条路走通,金融、医疗、保险等同样受监管、同样系统繁杂的行业,会更有信心采用类似模式。

展望与挑战

后续有几个值得观察的问题。第一,独立验证:第三方或客户能否复现类似的效率提升。第二,责任划分:当智能体建议出错、律师又没有发现时,责任如何分配,合同与保险条款是否跟上。第三,数据安全:合同中含有大量商业机密,数据如何隔离、是否用于训练,需要明确承诺。第四,稳定性:界面操作对页面变化敏感,长期运行的维护成本如何。第五,监管:各地对法律服务中使用自动化的规定不同,企业需要评估合规边界。

总体来看,这次合作的方向清楚,思路务实:不迷信单一技术,而是把界面操作、接口集成和人工审核组合起来。它能否兑现承诺,要看后续公开的数据与客户反馈。

Sources