E7 · 出版卷 29
人工审核与责任
审核角色、批准、升级与审计轨迹
*审核角色、批准、升级与审计轨迹*
学习目标与边界
本课是通用、机构中立内容,不使用任何真实公司、个人、矿权、项目或可识别地点。通用角色只描述职责,每个 SYN-AI 标识符都明确表示合成教学证据。
- 界定由“审核角色、批准、升级与审计轨迹”治理的决策。
- 区分生成建议、合格证据、确定性结果与负责任判断。
- 定义可测失败、弃答、升级与发布条件。
- 基于合成证据产出一套带审计轨迹的职责分离审核、批准与升级规程并为其控制辩护。
决策与专业边界
人工审核是一项带能力、范围、证据与权限的设计控制,不是某个人读完流畅文字后点击“批准”。应根据后果定义准备、领域审核、数据审核、风险审核与批准角色。审核者接收原子主张、证据片段、工具结果、备选方案、置信依据、限制与变更历史,并可作出接受、有条件接受、退回、拒绝或升级。
责任始终属于负责任的人员与治理流程。系统可以记录建议与证据,但不能拥有专业胜任能力、法定责任或知情同意。还必须考虑审核负荷:一次展示数百条不可核验主张的控制,只会造成自动化偏见与审核疲劳,而不是有效监督。
核心概念
| 概念 | 运行含义 | |---|---| | 审核胜任能力 | 完成声明审核范围所需的领域、数据、系统或风险能力。 | | 处置 | 带理由的版本化接受、有条件接受、退回、拒绝或升级决定。 | | 职责分离 | 高后果准备、验证与批准不由同一角色控制。 | | 可审核性 | 检查主张、证据、备选方案与变化所需的工作量。 | | 升级 | 当能力、证据、权限或风险容限被超出时进行的明确移交。 |
证据模型
审核包包括请求、任务合同、候选版本、变更集、原子主张、来源定位符、证据图、失败检查、竞争假设、置信记录、限制与候选发布状态。审计轨迹记录哪个角色审核了哪个版本、当时可见哪些证据、仍有哪些条件。教学案例中的角色标识只代表职责,无需暴露个人身份。
受控工作流
- 划分后果并分配必需审核角色。
- 组装有界审核包并突出变化。
- 先检查任务边界与证据完整度,再看措辞。
- 审核主张、矛盾、未知项、工具结果与置信度。
- 记录处置、理由、条件、失效期与责任角色。
- 发布前验证条件并保存完整审计轨迹。
每一步都输出版本化制品或明确失败。后续阶段只消费前一阶段经过验证的输出;对话上下文绝不能成为未记录的数据通道。
测量与验收准则
测量主张审核覆盖率、证据打开成功率、审核分歧、升级及时性、条件关闭、高后果错误逸出与每项主张审核负担。批准更快不一定更好;通过隐藏备选方案减少阅读时间可能增加风险。验收要求所有高后果主张、矛盾与发布条件都有明确处置。
$C_{review}=\frac{N_{claims\ with\ required\ dispositions}}{N_{claims\ requiring\ review}}$
| 关口 | 必需证据 | 发布后果 | |---|---|---| | 身份 | 可解析的主张、来源、配置与结果 ID | 任一身份含混即阻断 | | 依据 | 每项事实主张均到达充分来源片段 | 移除或扣留无来源主张 | | 独立性 | 血缘与分区检查证明无循环或目标信息 | 使受影响支持与评分失效 | | 审核 | 必需角色处置精确候选版本 | 候选保持未发布 | | 可复现性 | 清单、工具与检查能够重建证据包 | 退回数据包修正 |
主张—来源与系统合同
审核合同定义角色能力、范围、证据包、允许处置、必需理由、职责分离规则、条件、失效与升级路径。批准凭据绑定候选摘要与证据快照。主张、来源、模型、工具结果或政策变化影响审核范围时,原批准失效。
安全、隐私与访问边界
审核访问遵循最小权限并声明利益冲突。审核者只看到分配范围所需证据,审计系统则保留受完整性保护的事件。批准界面必须防止机械点击,突出显示失败控制,并对高后果发布要求加强授权。
人工审核与升级
定期使用植入缺陷、盲化重复审核包与分歧分析评价审核者和审核设计。不能因为存在某个角色就假定人工监督有效。当工作负荷或证据设计妨碍可靠审核时,应缩小范围、改进审核包或阻断发布,而不是记录名义批准。
合成案例详解
一份合成报告含十二项主张:八项直接观测、两项解释、一项靶区假设和一项限制。数据审核者解析 ID 与版本;领域审核者因某解释隐藏矛盾而退回;风险审核者要求限制与靶区陈述并列。只有新摘要证明条件已满足后才签发批准。轨迹同时保留被退回版本与修正版。
反例与失败分析
审核者只收到最终文字和一个绿色置信徽章;来源需要另行搜索,备选方案缺失,批准按钮默认启用。有人参与并不等于有效监督。审核必须暴露证据,并在运行上允许分歧、退回与升级。
常见失败模式
- 把任何人工点击都当作监督
- 不检查原子主张与来源就批准文字
- 让同一角色准备并批准高后果输出
- 重大变化后复用批准
- 忽略审核负荷与分歧
实践练习
- 为合成低、中、高后果任务分配审核角色。
- 设计一个突出变化与矛盾的审核包。
- 为五种重大变化编写批准失效规则。
- 为审核工作流建立植入缺陷测试。
考核制品
提交一套带审计轨迹的职责分离审核、批准与升级规程,并附来源清单、配置版本、验收证据、被拒案例、未解决风险,以及未选择某个合理备选控制的简要理由。如果图示或文字无法与机器可检查证据核对,制品即不完整。
验证检查点
把一项已发布合成主张逆向追踪,经过审核、置信、核验、证据图、工具结果或来源片段,直到不可变输入;再把一项被拒主张追踪到最早失败合同。根据清单重跑数据包并比较内容摘要。只有另一位审核者无需原对话即可重建接受与阻断路径、识别所有假设并复现发布决定,检查点才通过。对未解决风险应如实记录,不能用生成文字补全缺失事实。
来源
- ISO/IEC 42001:2023 人工智能管理体系, 关于责任管理、书面控制与持续改进的要求。
- 《人工智能风险管理框架 1.0》, 用于在全生命周期治理、映射、测量与管理情境相关 AI 风险的框架。
- ISO/IEC 23894:2023 人工智能风险管理指南, 将 AI 特定风险管理纳入活动与决策的指南。
- PROV-O 来源追溯本体, 描述实体、活动、责任角色与派生关系的标准模型。