ReAct、Plan-and-Execute 与 Reflection
ReAct 边想边做,Plan-and-Execute 先列计划再执行、靠 replan 触发条件救场, Reflection 让模型评审自己的输出 —— 前提是评审信号真的来自外部,否则只是自评偏差。推理模型把「手写规划」的一部分吸收进了模型内部,生产里最常见的形态是混合。
也叫:Agent 范式 · Plan-and-Execute · Reflection · replan · 自评偏差
三者的工程属性对比出自 T3-7
| 维度 | ReAct | Plan-and-Execute | Reflection |
|---|---|---|---|
| 决策粒度 | 每步 | 开头一次 | 产出后 |
| 适应变化 | 强 | 弱(除非 replan) | 中(只能事后补救) |
| 可预算/可估算 | 弱(步数不定) | 强(步数可见) | 中(轮数可控) |
| 可并行 | 差(天然串行) | 好(无依赖步骤可并发) | 差 |
| 可人工审批 | 难(没有整体计划可看) | 强(计划可先给人看) | — |
| 主要失败模式 | 绕圈、漂移 | 开环崩溃(照做错计划) | 自我肯定、无限修订 |
| 额外成本 | 中 | 中(多一次 planning 调用) | 高(近似翻倍) |
这张表是回答 Q3-07 的主干。 面试里能把"可人工审批"和"可并行"两列讲出来的人不多——它们恰恰是 Plan-and-Execute 在企业场景里真正的价值,而不是那句空洞的"更有条理"。
以上节选自T3-7 三种 Agent 范式的取舍——ReAct、Plan-and-Execute、Reflection,读全文能看到前后语境。
延伸阅读
T3-7 · 背景
修好开篇的故障:replan 的触发条件
三种 Agent 范式的取舍——ReAct、Plan-and-Execute、Reflection
T3-7 · 背景
Reflection 的前提:评审信号从哪来
三种 Agent 范式的取舍——ReAct、Plan-and-Execute、Reflection
T3-7 · 背景
选型判据
三种 Agent 范式的取舍——ReAct、Plan-and-Execute、Reflection
T3-7 · 旁支
时效:推理模型改变了什么(截至 2026-08)
三种 Agent 范式的取舍——ReAct、Plan-and-Execute、Reflection