Skip to content

第 5 章事实核验清单

本清单记录第 5 章可进入正文的陈述边界与 2026-07-15 的来源复核。只有表中“已复核”的限定陈述可以作为产品事实或来源建议;指令分层、内容类别、冲突矩阵、装配流程、教学案例和纯内存接口均是本书工程扩展。Fact Check 不替代正文写作当天的动态产品复核,也不替代后续图示审查、语言编辑或 Final Review。

| ID | 拟使用的陈述或用途 | 类型 | 来源 | 来源是否直接支持 | 状态 | 正文写作规则 | | --- | --- | --- | --- | --- | --- | | FC-01 | OpenAI Model Spec 的文档模型把指令分为 root、system、developer、user 与 guideline 等权威层,较高权威的指令覆盖较低权威的指令。 | 特定产品的公开 Spec | REF-010 | 是;页面直接描述权威层和冲突时的覆盖关系。 | 2026-07-15 已复核。 | 限定为该公开 Spec 的文档模型;不得写成所有模型、所有 API 或每次生产调用的统一消息顺序。 | | FC-02 | OpenAI Model Spec 页面说明公开 Spec 是预期行为,生产模型尚未完全反映该 Spec,并会持续更新。 | 特定产品的公开文档边界 | REF-010 | 是;页面明确写出生产模型与公开 Spec 的差异及持续更新。 | 2026-07-15 已复核。 | 用于限制 FC-01 的外推;不得据此推断任一模型版本或隐藏系统消息的实际内容。 | | FC-03 | Codex 可以使用全局与仓库、嵌套目录中的 AGENTS.md / override 文件组合项目指令;专门目录的规则应放在接近工作位置处。 | Codex 产品行为 | REF-005 | 是;官方页面说明全局指导、仓库层级和当前目录附近的覆盖示例。 | 2026-07-15 已复核。 | 只归因 Codex;不把发现规则、替代文件名、容量设置或示例命令外推给 Claude Code 或其他 Agent。 | | FC-04 | Claude Code 将 CLAUDE.md 作为人写入的持久项目指令上下文,并与 Auto memory 区分;其文档同时说明这些内容是上下文而非强制执行配置。 | Claude Code 产品行为与边界 | REF-006 | 是;官方文档直接说明持久上下文、加载方式与非强制性边界。 | 2026-07-15 已复核。 | 只归因 Claude Code;正文必须保留“规则不是权限或强制控制”的限定,不能写成 Codex 行为或通用安全机制。 | | FC-05 | Gemini API 文档建议以清晰、具体的指令表达预期;复杂 Prompt 可以拆为较简单的组件;复杂 JSON Schema 可使用该产品的 structured output。 | 特定产品的 Prompt 建议 | REF-011 | 是;官方页面分别说明清晰指令、组件拆分与复杂 JSON Schema 的建议。 | 2026-07-15 已复核。 | 只作为组织指令与输出契约的来源背景;不承诺跨模型效果、准确率或任何 SDK 字段。 | | FC-06 | Gemini structured output 文档明确指出:语法正确的 JSON 仍须由应用验证值;符合 Schema 的结果也可能在语义上不正确。 | 特定产品的结构化输出边界 | REF-012 | 是;页面的 validation 与 error handling 建议直接说明此边界。 | 2026-07-15 已复核。 | 可用于说明“格式通过不等于业务通过”;不得断言其他供应商支持相同 Schema 子集或验证行为。 | | FC-07 | Anthropic 的 Prompt 工程建议要求清晰、明确地说明输出与约束,并建议用 XML 标签区分复杂 Prompt 中的 instructions、context、examples 与 input。 | 特定产品的 Prompt 建议 | REF-013 | 是;官方页面直接给出清晰指令和 XML 结构化建议。 | 2026-07-15 已复核。 | 仅归因 Claude 的 Prompt 建议;标签不能被表述为通用语法、安全边界、权限控制或 Prompt injection 防护。 | | FC-08 | OpenAI API 文档说明不同模型快照之间的 Prompt 行为可能改变,并建议固定模型版本并运行 evals 以追求一致性。 | 特定产品的 API 稳定性建议 | REF-014 | 是;官方页面直接说明快照间行为变化和 pinned versions / evals 建议。 | 2026-07-15 已复核。 | 用于说明建立 Prompt 回归检查的动机;不得承诺固定版本或少量样例可消除输出变化。 | | FC-09 | 平台或系统约束、项目规则、任务请求、上下文数据和输出契约的五类内容模型;以及来源识别、范围判定、冲突记录、独立验证的装配流程。 | 本书工程模型 | 本章原创设计 | 不适用 | 2026-07-15 已确认其为本书扩展。 | 使用“本书提出”“本章的装配模型”等表达;不将其归因给任何厂商或写成统一运行时协议。 | | FC-10 | 代码审查 Agent 的规则化重构、must_fix / should_fix / suggestion 报告字段与纯内存 assembleInstructionPacket。 | 教学案例与计划示例 | 本项目原创设计 | 不适用 | 2026-07-15 已确认其为教学设计。 | 不写成真实团队审查记录、已运行模型调用、已验证供应商优先级或安全防护。 | | FC-11 | 产品 SDK、请求字段、模型名、模型快照、Schema 支持子集、隐藏指令、Prompt injection 防护、权限机制、工具调用和真实成功率。 | 动态或超出范围的事实 | 写作当天的官方资料 | 否,本章当前不需要 | 不纳入本章 | 如正文确有必要,先建立 TODO(verify): 证据卡;没有一手字段级证据就删除或缩小陈述。 | | FC-12 | pi 的访问日 README 列出四个默认工具,并把额外只读工具组置于默认关闭状态。 | 特定开源项目的动态文档 | REF-148 | 是;README 直接描述默认工具面。 | 2026-07-26 已复核。 | 只用于说明最小 Tool 面可以成为 Prompt 预算的一部分;不外推为其他 Harness 的默认值、安全性或质量保证。 | | FC-13 | pi 作者自述其系统提示词加工具定义低于 1000 token,并将四个工具的充分性作为刻意的工程取舍。 | 作者构建札记与自述数据 | REF-149 | 是;原文直接给出作者的预算与设计理由。 | 2026-07-26 已复核。 | 保留作者主语,不写 Terminal-Bench 具体名次或分数,不把自述预算改写成通用阈值或本书测量。 |

正文前与审查前的复核步骤

  1. 正文写作当天重新访问 REF-005、REF-006、REF-010 至 REF-014,核对 URL、页面标题、访问日期和上表的限定用途;页面内容、加载逻辑、模型行为与 structured output 支持范围变化时,以当天官方页面为准。
  2. 搜索草稿中的 OpenAICodexClaude CodeGeminiAGENTS.mdCLAUDE.mdsystemdeveloperuserJSON安全权限、模型名、版本号、数字、引号和绝对词。没有本表支持的陈述应删除、缩小或标为 TODO(verify):
  3. 将五类内容模型、冲突矩阵、装配步骤、输出报告字段、教学案例和纯内存示例明确标为“本书工程模型”“建议”或“教学设计”,不将它们伪装为外部来源结论。
  4. 审查图示,确认数据上下文被明确标为“待处理数据”,且冲突、拒绝、澄清、升级和独立验证均有文字含义;禁止绘制“标签 → 安全”“Prompt → 自动授权”或“模型输出 → 完成”的因果箭头。
  5. 正文若包含可运行示例,只能在实际实现、测试和执行记录产生后陈述运行结果;本次 Fact Check 不构成模型调用、SDK、文件系统、网络、工具、权限或安全测试的证据。

事实核验执行记录

  • REF-010: 使用官方 OpenAI Model Spec 的公开页面,重新核对了权威层、较高权威覆盖较低权威,以及“生产模型尚未完全反映公开 Spec”的限定。正文只把它作为 OpenAI 公开 Spec 的文档模型,不把它拼接为跨厂商协议。
  • REF-005: 重新读取 Codex 的 AGENTS.md 官方页面,核对全局与项目层级、嵌套规则和专门目录附近规则的说明。正文只用它解释 Codex 的项目指令示例,不推断其他工具的加载行为。
  • REF-006: 重新读取 Anthropic 的 How Claude remembers your project,核对 CLAUDE.md 的持久上下文角色、与 Auto memory 的区别及“上下文而非强制配置”的边界。正文不把 Markdown 规则描述为权限控制。
  • REF-011: 重新读取 Google 的 Prompting strategies,核对清晰具体的指令、复杂 Prompt 的组件拆分,以及复杂 JSON Schema 使用该产品 structured output 的建议。正文不将建议写成跨产品效果保证。
  • REF-012: 重新读取 Google 的 Structured outputs,核对语法正确 JSON 仍须验证值、Schema 合规结果仍可能有语义错误的限定。正文将格式验证与业务验证分开。
  • REF-013: 重新读取 Anthropic 的 Prompt engineering best practices,核对清晰明确的输出与约束、及用 XML 标签划分 instructions、context、examples 和 input 的建议。标签仅是特定产品的组织建议,不是安全控制。
  • REF-014: 重新读取 OpenAI API 的 Backwards compatibility 页面,核对快照间 Prompt 行为可能变化以及固定版本、运行 evals 的建议。正文只将其作为回归检查的背景,不承诺固定版本可保证稳定输出。
  • REF-148 / REF-149: 2026-07-26 重读 pi README 与作者构建札记,核对四个默认工具、默认关闭的只读工具组,以及作者自述的 Prompt/工具预算。正文保留项目版本边界与作者主语,不采用排名、动态统计或额外引语。
  • 未验证范围: 本次仅核验来源和建立图源,正文、示例实现、模型调用、产品 SDK、Mermaid 导出及图示视觉审查均尚未发生。后续阶段的真实结果必须单独记录,不能倒灌为本次 Fact Check 的证据。

从同一套 Markdown 书稿生成。