Skip to content

第 4 章事实核验清单

本清单限定第 4 章的可归因陈述。可靠性闭环、六条原则、任务契约、风险矩阵和受控配置案例均为本书工程扩展,不能包装为任一来源的原话或产品行为。

ID拟使用的陈述或用途类型来源是否直接支持状态正文写作规则
FC-01NIST AI RMF 1.0 旨在帮助设计、开发、部署或使用 AI 系统的组织管理风险,并促进可信与负责任的开发和使用;框架是自愿性的。来源事实是,REF-007 原始页面的摘要直接支持。2026-07-15 已复核。仅用于风险管理背景;不称为 Agent 验收的强制规范。
FC-02OpenAI 指南将 Guardrails 描述为分层防御,并指出它们应与认证、授权、访问控制和常规软件安全措施结合。官方工程建议是,REF-008 的 Guardrails 小节直接支持。2026-07-15 已复核。仅归因该指南;不写成单个 Prompt 或单层检查足以安全。
FC-03OpenAI 指南建议按工具的只读/写入、可逆性、账户权限与财务影响评估风险;高风险动作可先暂停检查或升级人工。官方工程建议是,REF-008 的 Tool safeguards 小节直接支持。2026-07-15 已复核。风险矩阵是本书扩展;动态产品集成细节在正文当天重查。
FC-04OpenAI 指南将失败阈值和敏感、不可逆、高风险动作列为人工介入的触发条件。官方工程建议是,REF-008 的 Human intervention 小节直接支持。2026-07-15 已复核。不虚构阈值数字或审批流程;这些需作为案例假设标明。
FC-05Google SRE 的 Canary 过程需要对子集投放变更、判断好坏的评价过程,以及把评价接入发布流程。来源事实是,REF-009 的 Requirements of a Canary Process 直接支持。2026-07-15 已复核。仅作为渐进变更的工程类比;不称为 Agent 专用模式。
FC-06Google SRE 说明不应一次将变更全量暴露;评价异常时应暂停、回滚或寻求人类协助。来源观点是,REF-009 的示例过程直接支持。2026-07-15 已复核。仅用于受控配置案例的设计理由,不给出生产事故概率。
FC-07Harness 与执行、上下文、工件和评估有关。来源观点是,REF-001 作为思想背景。2026-07-15 已复核。不把六条原则或图示归为原文固定结构。
FC-08可观察目标、验证闭环、失败记录、最小权限、人工升级和渐进扩大。本书工程模型不适用。2026-07-15 已确认为本书扩展。用“本书建议”或“教学案例”表述。
FC-09任何具体模型、SDK、权限 API、价格、成功率或生产部署能力。动态或未使用事实否,本章不需要。不纳入正文。如需使用,先建立 TODO(verify): 证据卡并重新查询官方资料。

审查前复核步骤

  1. 正文写作当天重新读取 REF-007、REF-008、REF-009 与 REF-001,确认页面标题、URL、访问日期和上述限定用途。
  2. 搜索正文中的“保证”“自动”“安全”“权限”“回滚”“准确率”“生产”“百分比”和版本号;未获本表支持的陈述删除、缩小或标为 TODO(verify):
  3. 确认图示没有“模型输出 → 完成”“Prompt → 权限”或“测试通过 → 全面正确”的直连因果箭头。
  4. 确认教学案例没有真实文件、账户、凭证、云平台、部署结果或未经运行的命令输出。

明确不核验的内容

本章不报告模型准确率、产品 SLA、Guardrails 的实际拦截率、云平台回滚 API、组织审批时限或任何真实配置变更结果。它们需要特定系统和当天证据,不能由本章的一般原则推断。

从同一套 Markdown 书稿生成。