Skip to content

第 9 章 Research Brief:Planning 与任务拆解

研究目标

为“Planning 与任务拆解”建立可追溯的事实边界:说明计划在研究方法、工作流设计和特定 SDK 编排中的不同含义,再将本书的 Plan Brief、可验收子任务、依赖图、停止条件与计划更新明确保留为工程模型。

本章要回答的问题

  1. 为什么“列出步骤”不足以构成一个可交接、可验证的计划?
  2. 子任务至少需要哪些输入、输出、依赖、验收和停止字段?
  3. 哪些任务可并行,哪些任务必须等待前置证据?
  4. 计划何时应被修订、停止或交给人工,而不是继续追加步骤?
  5. 计划、工作流状态机、Skill、Tool 与多 Agent 编排各自负责什么?

一手来源与允许用途

ID来源事实本章允许用途禁止外推
REF-028Plan-and-Solve Prompting 将其方法描述为先制定计划,把整体问题划分为更小子任务,再按计划执行;该研究针对其论文中的多步推理设置。说明“先分解、再执行”是一种已发表的提示方法,并作为缺步骤风险的研究背景。通用生产计划格式、依赖 DAG、真实任务验收、工具授权、成本收益或跨模型性能保证。
REF-004ReAct 研究交错生成推理轨迹与任务动作;论文说明推理轨迹可帮助跟踪、更新行动计划并处理例外。说明计划可随观察而调整的研究背景。本书的 Plan Brief 字段、任何产品的规划器实现、真实工具执行正确性或长期自治保证。
REF-029Anthropic 区分预定义代码路径编排的 workflow 与由模型动态决定过程和工具使用的 agent;该文建议先使用最简单方案,并指出 agentic 系统常以延迟和成本交换任务表现。说明预定义工作流与动态决策的设计取舍,以及不应默认采用更复杂编排。行业标准、固定架构分类、特定系统的性能、成本或安全结论。
REF-030OpenAI Agents SDK 文档区分由 LLM 决策与由代码编排两类 orchestration;文档列出结构化输出分类、串联、评估循环和独立任务并行为代码编排模式。说明该 Python SDK 中的编排选项及“独立任务才可并行”的限定例子。所有 Agent 的规划算法、任何语言 SDK 的 API、并行任务一定安全或更快、跨产品的默认行为。

本书工程模型

下列内容是本书为工程读者提出的工作分解模型,不归因给上述论文或产品文档:

  • Plan Brief: 目标、约束、可观测完成条件、已知未知项、风险、停止条件和人工升级条件。
  • 任务卡: 任务名称、输入、输出、依赖、允许副作用、验收证据、失败表示、负责人或交接对象。
  • 任务图: 只将有明确依赖的边画为顺序关系;没有共享状态、资源冲突或证据依赖的任务才可作为并行候选。
  • 计划修订: 新观察只能触发局部重排、补充证据、停止或人工升级;不能把“模型生成了新计划”写成任务已经完成。
  • 计划与工作流的边界: 计划回答“为什么做什么、依赖什么、何时停止”;第 10 章的工作流回答“状态怎样保存、迁移、重试和恢复”。

章节范围与非目标

本章讨论目标澄清、任务卡、依赖、并行候选、风险、停止条件和计划更新。它不实现具体 Planner、不定义可恢复状态机(第 10 章)、Tool 协议(第 11 章)、运行环境权限(第 12 章)、多 Agent 隔离(第 26 章)或企业项目管理流程。

计划正文结构

  1. 从愿望清单到 Plan Brief:把完成条件和停止条件写出来。
  2. 任务卡:让输入、输出、依赖和验收可检查。
  3. 依赖图与并行候选:以证据、共享资源和副作用判断边。
  4. 执行中更新计划:根据观察修订,而不把计划文本当执行结果。
  5. 失败与升级:范围不明、依赖阻塞、风险过高和证据不足时停止或请求人工决策。
  6. 案例:把“为 API 增加认证测试”拆成研究、实现、验证和文档任务。

拟议图示与示例边界

  • 图示: “需求 → Plan Brief → 任务卡 → 依赖检查 → 可执行/阻塞/升级 → 观察 → 计划修订”的有向无环关系;图只表达本书模型。
  • 最小示例: 纯内存函数只根据注入的任务卡检查依赖、验收字段和副作用边界,返回可执行、阻塞、需要批准或不适用;不调用模型、网络、文件、Tool、权限系统或真实测试。
  • 案例: API 认证测试任务拆解使用假设输入,不代表本仓库、某个 API 或生产测试计划。

动态信息与写作要求

  • REF-030 是持续演进的 SDK 文档;正文写作当天必须重新读取,并只使用当时可见的官方限定陈述。
  • REF-029 是官方工程文章而非标准;正文不得将其模式名称或建议改写为强制规则。
  • 论文实验设置、模型、数据集和性能数字若不是本章直接需要的事实,则不写入正文;若需要,必须回到论文原文逐项核验。
  • 对任何真实 Planner、并行执行、批准、任务管理或 API 测试行为,使用 TODO(verify): 与独立运行证据,不能复用本 Brief 的教学模型。

Research 完成检查

  • [x] 每条可归因陈述都限定了来源、允许用途和外推禁区。
  • [x] 区分论文方法、官方产品文档、官方工程建议与本书工作分解模型。
  • [x] 定义正文、图示、示例和案例的非事实边界。
  • [x] 为动态 SDK 行为记录写作日复核要求。

从同一套 Markdown 书稿生成。