深度剖析 / 架构与模式
架构与模式
可复用的智能体架构——ReAct、Plan-and-Execute、Supervisor-Worker、Router、Reflection——以及何时该用哪一种。
- 智能体设计模式全景为什么架构是可靠性杠杆,以及比较每种模式的五个坐标轴。
- ReAct——交错进行推理与行动主力工具循环:控制流、交错为何取胜,以及规模化时的失败模式。
- Plan-and-Execute——先分解,再运行规划器/执行器拆分、重规划策略,以及预先计划何时成为负担。
- 反思——验证、批评、修订self-refine 与 Reflexion,为何外部信号是关键,以及自我批评何时有害。
- 搜索策略——在轨迹上分支Best-of-N、自一致性、思维树/图:成本区间与对打分器的依赖。
- 路由与分派——选择、扇出、并行分类器与工具调用路由、并行扇出,以及路由层的失败模式。
- 工具使用循环与错误恢复失败分类法、分层恢复、错误消息即提示词,以及副作用持久性。
- 单智能体 vs. 多智能体编排拆分的真实理由、监督者/工作者与交接、协调税,以及一个决策框架。
- 持久执行:LangGraph + Temporal节点间 checkpointer 与节点内 Temporal——回放语义、LangGraph 循环为何在 1 万条时撑不住,以及"推理图 + 持久运行时"这一模式。
- 上下文缓存经济学跨厂商缓存计价(Anthropic 写 1.25×/读 0.1×;Gemini 减 90%;OpenAI 自动 75%-90%)、TTL 取舍,以及缓存与批处理叠加至约减 95% 的做法。
- 浏览器智能体的失败模式WebArena 抓不到的六种失败模式——DOM 漂移、截图歧义、登录状态、模态弹窗打断、限流断崖、不可逆操作。
- Claude Managed Agents 架构把持久会话建模为只追加事件日志、无状态外壳、wake(sessionId) 恢复——以及这一模式放弃了什么。
- 端侧智能体架构本地推理换来的是边际成本归零、内层循环无网络、以及离线可用——但换不来隐私,因为工具照样出网。把循环切成五份,按一张静态的动作属性清单来升级,并把设备边缘当成一条只是长得像安全边界的性能边界。