外观
第 9 章 Research Brief:Planning 与任务拆解
研究目标
为“Planning 与任务拆解”建立可追溯的事实边界:说明计划在研究方法、工作流设计和特定 SDK 编排中的不同含义,再将本书的 Plan Brief、可验收子任务、依赖图、停止条件与计划更新明确保留为工程模型。
本章要回答的问题
- 为什么“列出步骤”不足以构成一个可交接、可验证的计划?
- 子任务至少需要哪些输入、输出、依赖、验收和停止字段?
- 哪些任务可并行,哪些任务必须等待前置证据?
- 计划何时应被修订、停止或交给人工,而不是继续追加步骤?
- 计划、工作流状态机、Skill、Tool 与多 Agent 编排各自负责什么?
一手来源与允许用途
| ID | 来源事实 | 本章允许用途 | 禁止外推 |
|---|---|---|---|
| REF-028 | Plan-and-Solve Prompting 将其方法描述为先制定计划,把整体问题划分为更小子任务,再按计划执行;该研究针对其论文中的多步推理设置。 | 说明“先分解、再执行”是一种已发表的提示方法,并作为缺步骤风险的研究背景。 | 通用生产计划格式、依赖 DAG、真实任务验收、工具授权、成本收益或跨模型性能保证。 |
| REF-004 | ReAct 研究交错生成推理轨迹与任务动作;论文说明推理轨迹可帮助跟踪、更新行动计划并处理例外。 | 说明计划可随观察而调整的研究背景。 | 本书的 Plan Brief 字段、任何产品的规划器实现、真实工具执行正确性或长期自治保证。 |
| REF-029 | Anthropic 区分预定义代码路径编排的 workflow 与由模型动态决定过程和工具使用的 agent;该文建议先使用最简单方案,并指出 agentic 系统常以延迟和成本交换任务表现。 | 说明预定义工作流与动态决策的设计取舍,以及不应默认采用更复杂编排。 | 行业标准、固定架构分类、特定系统的性能、成本或安全结论。 |
| REF-030 | OpenAI Agents SDK 文档区分由 LLM 决策与由代码编排两类 orchestration;文档列出结构化输出分类、串联、评估循环和独立任务并行为代码编排模式。 | 说明该 Python SDK 中的编排选项及“独立任务才可并行”的限定例子。 | 所有 Agent 的规划算法、任何语言 SDK 的 API、并行任务一定安全或更快、跨产品的默认行为。 |
本书工程模型
下列内容是本书为工程读者提出的工作分解模型,不归因给上述论文或产品文档:
- Plan Brief: 目标、约束、可观测完成条件、已知未知项、风险、停止条件和人工升级条件。
- 任务卡: 任务名称、输入、输出、依赖、允许副作用、验收证据、失败表示、负责人或交接对象。
- 任务图: 只将有明确依赖的边画为顺序关系;没有共享状态、资源冲突或证据依赖的任务才可作为并行候选。
- 计划修订: 新观察只能触发局部重排、补充证据、停止或人工升级;不能把“模型生成了新计划”写成任务已经完成。
- 计划与工作流的边界: 计划回答“为什么做什么、依赖什么、何时停止”;第 10 章的工作流回答“状态怎样保存、迁移、重试和恢复”。
章节范围与非目标
本章讨论目标澄清、任务卡、依赖、并行候选、风险、停止条件和计划更新。它不实现具体 Planner、不定义可恢复状态机(第 10 章)、Tool 协议(第 11 章)、运行环境权限(第 12 章)、多 Agent 隔离(第 26 章)或企业项目管理流程。
计划正文结构
- 从愿望清单到 Plan Brief:把完成条件和停止条件写出来。
- 任务卡:让输入、输出、依赖和验收可检查。
- 依赖图与并行候选:以证据、共享资源和副作用判断边。
- 执行中更新计划:根据观察修订,而不把计划文本当执行结果。
- 失败与升级:范围不明、依赖阻塞、风险过高和证据不足时停止或请求人工决策。
- 案例:把“为 API 增加认证测试”拆成研究、实现、验证和文档任务。
拟议图示与示例边界
- 图示: “需求 → Plan Brief → 任务卡 → 依赖检查 → 可执行/阻塞/升级 → 观察 → 计划修订”的有向无环关系;图只表达本书模型。
- 最小示例: 纯内存函数只根据注入的任务卡检查依赖、验收字段和副作用边界,返回可执行、阻塞、需要批准或不适用;不调用模型、网络、文件、Tool、权限系统或真实测试。
- 案例: API 认证测试任务拆解使用假设输入,不代表本仓库、某个 API 或生产测试计划。
动态信息与写作要求
- REF-030 是持续演进的 SDK 文档;正文写作当天必须重新读取,并只使用当时可见的官方限定陈述。
- REF-029 是官方工程文章而非标准;正文不得将其模式名称或建议改写为强制规则。
- 论文实验设置、模型、数据集和性能数字若不是本章直接需要的事实,则不写入正文;若需要,必须回到论文原文逐项核验。
- 对任何真实 Planner、并行执行、批准、任务管理或 API 测试行为,使用
TODO(verify):与独立运行证据,不能复用本 Brief 的教学模型。
Research 完成检查
- [x] 每条可归因陈述都限定了来源、允许用途和外推禁区。
- [x] 区分论文方法、官方产品文档、官方工程建议与本书工作分解模型。
- [x] 定义正文、图示、示例和案例的非事实边界。
- [x] 为动态 SDK 行为记录写作日复核要求。
