外观
第 4 章事实核验清单
本清单限定第 4 章的可归因陈述。可靠性闭环、六条原则、任务契约、风险矩阵和受控配置案例均为本书工程扩展,不能包装为任一来源的原话或产品行为。
| ID | 拟使用的陈述或用途 | 类型 | 来源是否直接支持 | 状态 | 正文写作规则 |
|---|---|---|---|---|---|
| FC-01 | NIST AI RMF 1.0 旨在帮助设计、开发、部署或使用 AI 系统的组织管理风险,并促进可信与负责任的开发和使用;框架是自愿性的。 | 来源事实 | 是,REF-007 原始页面的摘要直接支持。 | 2026-07-15 已复核。 | 仅用于风险管理背景;不称为 Agent 验收的强制规范。 |
| FC-02 | OpenAI 指南将 Guardrails 描述为分层防御,并指出它们应与认证、授权、访问控制和常规软件安全措施结合。 | 官方工程建议 | 是,REF-008 的 Guardrails 小节直接支持。 | 2026-07-15 已复核。 | 仅归因该指南;不写成单个 Prompt 或单层检查足以安全。 |
| FC-03 | OpenAI 指南建议按工具的只读/写入、可逆性、账户权限与财务影响评估风险;高风险动作可先暂停检查或升级人工。 | 官方工程建议 | 是,REF-008 的 Tool safeguards 小节直接支持。 | 2026-07-15 已复核。 | 风险矩阵是本书扩展;动态产品集成细节在正文当天重查。 |
| FC-04 | OpenAI 指南将失败阈值和敏感、不可逆、高风险动作列为人工介入的触发条件。 | 官方工程建议 | 是,REF-008 的 Human intervention 小节直接支持。 | 2026-07-15 已复核。 | 不虚构阈值数字或审批流程;这些需作为案例假设标明。 |
| FC-05 | Google SRE 的 Canary 过程需要对子集投放变更、判断好坏的评价过程,以及把评价接入发布流程。 | 来源事实 | 是,REF-009 的 Requirements of a Canary Process 直接支持。 | 2026-07-15 已复核。 | 仅作为渐进变更的工程类比;不称为 Agent 专用模式。 |
| FC-06 | Google SRE 说明不应一次将变更全量暴露;评价异常时应暂停、回滚或寻求人类协助。 | 来源观点 | 是,REF-009 的示例过程直接支持。 | 2026-07-15 已复核。 | 仅用于受控配置案例的设计理由,不给出生产事故概率。 |
| FC-07 | Harness 与执行、上下文、工件和评估有关。 | 来源观点 | 是,REF-001 作为思想背景。 | 2026-07-15 已复核。 | 不把六条原则或图示归为原文固定结构。 |
| FC-08 | 可观察目标、验证闭环、失败记录、最小权限、人工升级和渐进扩大。 | 本书工程模型 | 不适用。 | 2026-07-15 已确认为本书扩展。 | 用“本书建议”或“教学案例”表述。 |
| FC-09 | 任何具体模型、SDK、权限 API、价格、成功率或生产部署能力。 | 动态或未使用事实 | 否,本章不需要。 | 不纳入正文。 | 如需使用,先建立 TODO(verify): 证据卡并重新查询官方资料。 |
审查前复核步骤
- 正文写作当天重新读取 REF-007、REF-008、REF-009 与 REF-001,确认页面标题、URL、访问日期和上述限定用途。
- 搜索正文中的“保证”“自动”“安全”“权限”“回滚”“准确率”“生产”“百分比”和版本号;未获本表支持的陈述删除、缩小或标为
TODO(verify):。 - 确认图示没有“模型输出 → 完成”“Prompt → 权限”或“测试通过 → 全面正确”的直连因果箭头。
- 确认教学案例没有真实文件、账户、凭证、云平台、部署结果或未经运行的命令输出。
明确不核验的内容
本章不报告模型准确率、产品 SLA、Guardrails 的实际拦截率、云平台回滚 API、组织审批时限或任何真实配置变更结果。它们需要特定系统和当天证据,不能由本章的一般原则推断。
