PROJECT 02

合同智审

企业签约前 AI 风险审阅工作流

不是「AI 帮你看看合同有没有风险」,而是让 AI 进入真实企业签约决策流程。

ROLE

AI Product Lead

TYPE

Enterprise B2B · RAG · AI Workflow

SCOPE

Product Definition · Workflow Design · Multi-source Knowledge · Evaluation

STATUS

Interactive Prototype

合同智审 — 企业签约前 AI 风险审阅工作流

Customer Problem

客户问题

真实企业合同审核并不是只阅读合同文本。一次签约判断可能同时依赖合同条款、企业制度、投标承诺、项目实际交付条件、报价信息和历史合同。如果只把合同上传给大模型,模型即使能够解释法律条款,依然无法回答:这份合同对于这家公司、这个项目、这次交易到底有没有风险。

多源信息割裂

合同、企业制度、投标承诺分散在不同系统和文件中,审阅时需要人工来回比对,遗漏风险高。

风险责任人不清晰

发现问题后「谁来处理」「是否已处理」缺少闭环,多轮修改无法追踪问题是否真正关闭。

审阅依赖个人经验

审阅质量高度依赖个人经验和注意力,缺乏系统性的校验和审计机制。

AI 判断容易被误认为企业正式判断

模型生成的风险分析和建议如果未经区分,可能被直接采纳为决策依据,产生不可追溯的责任问题。

因此产品目标不是「自动替代法务」,而是建立一个有人负责、有证据、可复核、可追踪的签约风险工作流。

What I Did

我做了什么

将「合同 AI 审阅」重构为多源知识驱动的风险管理流程:

多源材料输入

不是只上传合同。系统同时接入企业制度、投标承诺、项目事实和历史合同数据。不同来源标注不同权威等级。

风险结构化

每个风险项包含:风险等级、原因、证据来源、修改建议、责任人和当前状态。严格区分原文事实、企业规则、模型判断和人工决策。

Human Decision 作为核心节点

高风险、证据不足、规则冲突、系统查询失败、重大商务承诺 —— 这些节点必须经过人工确认并记录决策,禁止模型自动通过。

Re-review & Audit Trail

修改后自动进入复核,所有人工决策、风险状态变化和最终决策都记录在审计日志中,从第一天设计就包含审计能力。

多源材料输入引擎风险结构化与证据链Owner 责任机制Human Decision 阀门Re-review 流程Audit Log 设计Evaluation 框架交互原型

Key Decisions

关键决策

DECISION 01

拒绝「单合同文本审查」模式

为什么

合同不是唯一事实源。真实风险需要和企业规则、投标承诺、项目事实交叉判断。单合同审查只是看起来更快,但遗漏的风险可能是致命的。

决策

系统必须接入多源业务材料,不同来源标注不同的权威等级和优先级。

取舍

增加了材料准备和配置的工作量,但使审查结果不再是脱离业务的条文解释。

DECISION 02

严格区分事实与判断四层模型

为什么

模型输出的推理和判断如果与合同事实混在一起,可能被误认为正式结论。

决策

在系统中严格区分:原始合同事实 → 企业规则 → AI 判断 → 人工决策,四层信息不可混淆。

取舍

界面上的信息密度增加,但每层信息的可追溯性都得到了保证。

DECISION 03

Human-in-the-loop 不是附加的确认按钮

为什么

如果人工决策是系统流程中的核心节点,而不是事后补救,产品信任度会大幅提升。

决策

高风险、证据不足、规则冲突、重大商务承诺和法务最终判断 —— 这些是系统的核心阀门,非可选步骤。

取舍

自动化程度降低,但每一次自动判断都有明确的边界和责任归属。

DECISION 04

从第一天设计 Audit Trail

为什么

企业签约是高风险决策,事后追溯「谁在什么时候做了什么判断」是法务和合规的基本要求。

决策

人工修改、风险状态变化、最终决策 —— 所有操作都产生审计记录,不是后加的功能。

取舍

系统设计约束更多,但从第一天就满足企业合规的基础要求。

Results

成果

完成从「单文本 AI Review」到「企业签约风险 Workflow」的产品重构:

Product

完成从单文本 AI 审阅到多源签约风险工作流的产品定义。

System

形成 Risk → Evidence → Owner → Decision → Re-review → Audit 的结构化流程。

Prototype

展示材料输入、风险分析、风险列表、修改建议及人工确认流程的完整交互原型。

Evaluation

定义风险召回、证据正确性、人工接受率、问题关闭率、审阅周期、审计完整性等指标。

当前为产品设计与交互原型阶段。企业规则库、OA/SAP 系统集成和法务生产环境验证属于 Future State。

Product System

产品系统设计

以人工决策为核心的风险审阅流程:

1输入层
材料收集事实抽取
2分析层
多源核对风险分析Evidence 证据展示
3决策层
Human Decision修订Re-review 复核
4审计层
Audit 审计记录

Evaluation

如何验证

围绕风险审阅工作流建立评价体系 —— 目前为 Evaluation Framework:

Evaluation Framework

风险召回

是否覆盖了所有合同条款中的风险点,是否存在遗漏。

Evaluation Framework

证据正确性

每个风险是否有对应证据支持,证据是否能被追溯到来源。

Evaluation Framework

人工接受率

AI 建议被人工采纳的比例,反映建议质量而非替代人工。

Evaluation Framework

问题关闭率

风险项从 Open 到 Closed 的完成情况,是否所有问题都有闭环。

Evaluation Framework

审阅周期

从材料提交到完成审阅的时间,用于比较前后效率(需真实业务验证)。

Evaluation Framework

审计完整性

是否所有决策都可追溯,审计日志是否完整覆盖关键节点。

Product Demo

产品展示

合同智审 — Product Demo加载中...
新窗口

建议在桌面端查看原型,或点击「新窗口」。

正在加载...

风险项工作台 —— 每个 Risk 同时绑定 Evidence、Owner、Decision 和当前状态,形成完整的风险管理闭环。

Analysis Framework

产品分析框架

合同智审 — Analysis Framework加载中...
新窗口

建议在桌面端查看原型,或点击「新窗口」。

正在加载...

Future State

后续迭代

当前为产品设计与交互原型阶段。后续需要在真实企业环境中验证的方向:

  • 接入真实企业规则库与合同解析服务
  • OA / SAP 系统集成
  • 法务生产环境验证
  • 审批权限与组织架构对接