ReAct、Plan-and-Execute 与 Reflection

Agent 开发进阶3讲解 5

ReAct 边想边做,Plan-and-Execute 先列计划再执行、靠 replan 触发条件救场, Reflection 让模型评审自己的输出 —— 前提是评审信号真的来自外部,否则只是自评偏差。推理模型把「手写规划」的一部分吸收进了模型内部,生产里最常见的形态是混合。

也叫:Agent 范式 · Plan-and-Execute · Reflection · replan · 自评偏差

三者的工程属性对比出自 T3-7

维度 ReAct Plan-and-Execute Reflection
决策粒度 每步 开头一次 产出后
适应变化 弱(除非 replan) 中(只能事后补救)
可预算/可估算 弱(步数不定) (步数可见) 中(轮数可控)
可并行 差(天然串行) (无依赖步骤可并发)
可人工审批 难(没有整体计划可看) (计划可先给人看)
主要失败模式 绕圈、漂移 开环崩溃(照做错计划) 自我肯定、无限修订
额外成本 中(多一次 planning 调用) (近似翻倍)

这张表是回答 Q3-07 的主干。 面试里能把"可人工审批"和"可并行"两列讲出来的人不多——它们恰恰是 Plan-and-Execute 在企业场景里真正的价值,而不是那句空洞的"更有条理"。

以上节选自T3-7 三种 Agent 范式的取舍——ReAct、Plan-and-Execute、Reflection,读全文能看到前后语境。

延伸阅读

考这个知识点的题1

会连带问到2