外观
第 9 章事实核验:Planning 与任务拆解
核验范围
本清单核验 09-planning-and-task-decomposition.md、.research.md、.references.md、.outline.md、.example-plan.md、纯内存示例和 Mermaid 图中可归因的论文、官方工程文章与 SDK 文档陈述。计划摘要(Plan Brief)、任务卡(Task Card)、任务图、依赖分类、并行候选、状态、修订记录、停止规则、API 认证测试案例、纯内存函数和图示均为本书工程模型或教学工件,不作为产品或论文接口核验。
来源级核验
| ID | 写作日复核的来源陈述 | 正文允许用途 | 禁止外推 | 状态 |
|---|---|---|---|---|
| REF-028 | Plan-and-Solve 提出先制定计划、把整体任务分为更小子任务,再按计划完成子任务,以处理其论文中的多步推理问题。 | 说明“先计划、再拆分”的研究背景。 | 生产任务图、Tool 调用、状态机、权限、治理规则或本书字段。 | 2026-07-15 已重读 ACL 原始论文页面。 |
| REF-004 | ReAct 探索交错生成推理轨迹与任务动作;摘要称推理轨迹可帮助诱导、跟踪和更新行动计划,并处理例外。 | 说明观察与计划更新的研究背景。 | Plan Brief、任务卡、状态名称、自动完成、外部执行安全或通用产品行为。 | 2026-07-15 已重读 arXiv v3 页面。 |
| REF-029 | Anthropic 将 workflow 描述为预定义代码路径中的 LLM 与 Tool 编排,将 agent 描述为由 LLM 动态决定过程与 Tool 使用;文章建议从简单方案开始,只在需要时增加复杂度,并提示成本、延迟和性能取舍。 | 限定说明 workflow/agent 区别、简单可组合模式与复杂度取舍的工程建议。 | 强制架构标准、跨产品实现、并发安全、权限、成本或性能保证。 | 2026-07-15 已重读 Building effective agents。 |
| REF-030 | OpenAI Agents SDK 的 Python 文档将编排区分为让 LLM 决定步骤和由代码决定流程;代码编排段落列举结构化输出、串联、评估循环,以及对不相互依赖任务并行的示例。 | 说明该 SDK 文档中的两种编排方式和“独立任务”并行的限定示例。 | 其他 SDK 的 API、任何任务图的调度语义、默认并行安全、真实授权或性能承诺。 | 2026-07-15 已重读 Agent orchestration。 |
本书模型与非事实边界
| 工件或术语 | 事实状态 | 核验结论 |
|---|---|---|
| Plan Brief、任务卡、任务图与三类依赖 | 本书工程模型。 | 字段、箭头理由、默认动作和验收要求不属于 REF-004、REF-028 至 REF-030 的共同接口。 |
ready、blocked、requires_approval、not_ready | 本书教学状态。 | 不代表论文、Anthropic、OpenAI Agents SDK、Planner、Tool 或权限系统的返回值。 |
| API 认证测试案例 | 原创教学案例。 | 未连接真实 API,未构造 endpoint、token、账户、凭证、HTTP 响应或测试结果。 |
assessTaskPlan | 纯内存示例。 | 只处理注入对象,不生成计划、不调度任务,也不调用模型、网络、文件、测试框架、Tool 或权限系统。 |
| Plan Brief 到任务图的 Mermaid 图 | 本书工程模型。 | 图中并行仅是候选,写入/环境问题转向批准;没有真实执行或验证节点。 |
事实陈述核对
| 正文主题 | 归因来源 | 核验结果 | 写作限制 |
|---|---|---|---|
| 先制定计划、拆分子任务并依计划完成。 | REF-028 | 与论文摘要一致。 | 保留为研究背景;不引用性能数字或扩展为工程标准。 |
| 推理与行动交错,计划可被跟踪、更新并处理例外。 | REF-004 | 与论文摘要一致。 | 保留为研究背景;不把本书修订记录或任务卡归因给 ReAct。 |
| workflow/agent 区分与“先简后繁”的建议。 | REF-029 | 与该官方工程文章一致。 | 明确这是 Anthropic 的工程建议,不是所有系统的架构、权限或成本结论。 |
| LLM 编排、代码编排及独立任务并行。 | REF-030 | 与该 Python SDK 文档一致。 | 明确是该 SDK 的文档;“独立”不替代本章资源、副作用、验收和批准检查。 |
| Plan Brief、依赖理由、并行候选、停止与升级。 | 本书模型。 | 正文和图示已明确标注。 | 不声称任一来源规定字段、状态或任务图接口。 |
| 纯内存状态与 6 条测试路径。 | 本仓库示例。 | 2026-07-15 重跑测试与演示。 | 只证明固定对象的确定性函数行为。 |
示例与图示复核
2026-07-15 实际运行:
bash
npm run test:task-plan-assessment
npm run example:task-plan-assessment测试结果为 6 项通过、0 项失败;演示输出 ready / ready_for_planned_task。这些结果只说明 assessTaskPlan 对注入的 Plan Brief、任务卡、依赖、效果批准快照和资源标签返回预期的教学状态;它们不验证真实任务拆解、API 认证、并行调度、Tool 调用、文件访问、环境、凭证、批准、身份或源系统权限。
Mermaid 图源已由 Mermaid CLI 11.16.0 导出 SVG/PNG 并实际查看。该渲染只验证本书图源可生成可读发布图,不验证图中任何论文方法、产品行为、真实授权、外部动作或结果正确性。
动态信息与待复核项
- OpenAI Agents SDK 的模块、API、版本、示例、并发方式和行为在正文或示例更新当天必须重新访问 REF-030;本章没有引用这些动态实现细节。
- Anthropic 工程文章的产品、框架、模型和示例若被新增引用,必须重新访问 REF-029;本章只保留其明确的工程建议与区分。
TODO(verify):若以后接入真实 Planner、任务队列、并发库、API 认证、测试框架、Tool、环境、凭证或人工批准,应建立各自的一手来源、权限设计和运行证据;不得复用本章纯内存示例、图示或论文背景作为执行或授权证明。
Fact Check 完成检查
- [x] REF-004、REF-028 至 REF-030 已在 2026-07-15 重新读取并限定允许用途和外推禁区。
- [x] 正文将论文或官方工程/SDK 资料、本书模型、教学案例、示例和图示分开。
- [x] 已重跑第 9 章 6 项纯内存测试与演示,并记录其非产品边界。
- [x] 已记录动态 SDK 与未来真实集成需要重新取证的条件。
- [x] 未把计划、任务图、并行候选、图示、论文背景或纯内存结果表述为真实调度、授权、执行或验证保证。
