先选循环,再谈框架

Agent 的骨架是「推理—行动」循环,不是把 LLM 包一层 API。常见范式:

  • ReAct:走一步算一步,灵活,但容易循环漂移、错误一路传下去。
  • Plan-and-Execute:先出计划再执行,每步核对是否和预期一致,失败则动态重规划。
  • Reflection / Reflexion:执行后复盘;Reflexion 还会把失败原因写入记忆,下次少踩同样的坑。

Workflow、Goal、hook、任务拆分、规则引擎约束,都是这些循环上的装配件,不必各开一篇空草稿。

落地顺序

单 Agent + 工具白名单跑通,再加停止条件和日志,最后才是 Multi-Agent。CoT / ToT / GoT 是思考拓扑,不是另一套产品;和 ReAct 一起看 token 消耗,不要默认越复杂越准。