Agent 框架选型
选框架选的是「交出多少控制权」:框架替你做了循环、状态、重试与追踪,抽象泄漏就发生在你要改这些默认行为的时候。LangGraph / Agents SDK / ADK / CrewAI 定位不同;不少团队最后自己写循环,是因为循环本身只有几十行,而绞杀者式重写比迁移框架便宜。
也叫:框架选型 · LangGraph · Agents SDK · ADK · CrewAI · 抽象泄漏 · 自己写循环
为什么不少团队最后自己写循环出自 T3-9
这不是反框架情绪,是有具体原因的工程选择:
- 核心循环本来就很短。T3-3 那 40 行是完整的,加上退出条件、重复检测也不到 150 行。
- 调试成本反转。出问题时,读自己的 150 行 vs 读框架的调用栈 + 猜抽象内部发生了什么——后者往往更贵。
- 上下文控制权是产品核心。prompt、工具描述、压缩策略都是要反复打磨的东西(T3-2、T3-6),中间隔一层模板会让迭代变慢。
- 升级风险。框架大版本变更、被转入维护模式、API 重构,都会打断你。
- 性能与成本的最后一公里:缓存前缀设计、工具返回裁剪、模型分级路由(T3-12),这些优化经常要绕过框架的默认行为。
但"自己写循环"不等于"什么都自己造"。 成熟团队的实际形态是:
自己写:循环 + 上下文组装 + 工具分发 + 退出条件 ← 掌握控制权
借生态:可观测/trace(OTel 生态)、持久化(工作流引擎或数据库)、
评测框架、MCP SDK(协议实现别自己撸) ← 不重复造轮子面试里能给出这个分界,比站队"用框架"或"不用框架"高一个层级。
以上节选自T3-9 Agent 框架选型——你在选的是"交出多少控制权",读全文能看到前后语境。