Skip to content

第 16 章候选参考资料:Reflection 与经验提炼

本文件保留 C16-REF-* 作为局部追溯键;它们已登记为正式 REF-057 至 REF-060,正文和全局引用表使用正式编号。

本地键来源来源类型支持的具体陈述访问日期外推禁区
C16-REF-01Shinn et al., Reflexion: Language Agents with Verbal Reinforcement Learning原始论文 / arXiv v4语言 Agent 可从任务反馈生成语言反思,并以情景记忆影响后续尝试的研究方法。2026-07-16不引用性能数字;不把论文方法、记忆结构或任务结果写成本书实现。
C16-REF-02Madaan et al., Self-Refine: Iterative Refinement with Self-Feedback原始论文 / arXiv v2初始输出可进入由反馈和精炼构成的迭代过程;论文描述单 LLM 可承担多个角色。2026-07-16不使用人类偏好、平均改善或跨任务有效性数字;自反馈不等于外部验证。
C16-REF-03Google SRE Book: Postmortem Culture: Learning from Failure官方工程实践事后分析可记录事件、影响、处置、成因与预防行动;无责、建设性复盘有助于让问题显性化。2026-07-16不把组织流程、阈值、文化或效果声明外推为 Agent 自动根因分析。
C16-REF-04Anthropic: Building Effective AI Agents官方工程文章evaluator-optimizer 是生成与评价反馈循环;它更适合评估标准清晰、迭代精炼具有可测价值的情形。2026-07-16不作为跨产品标准;不把模型自评、工作流或安全结论外推到未验证系统。

正式映射(已完成)

  • C16-REF-01REF-057C16-REF-02REF-058C16-REF-03REF-059C16-REF-04REF-060;全局条目已登记到 .ai/references.md,正文已使用正式编号。
  • Anthropic 页面为动态工程文章;正式写作或发布前需在当日重读。
  • 两篇论文应保留明确版本 URL;若更新版本改变摘要或方法描述,重新核验允许陈述。
  • 不复制论文长段落、图表、性能数值或 SRE 页面案例;本章只使用最小可归因背景。

从同一套 Markdown 书稿生成。