框架图谱:LangGraph、AutoGen、CrewAI 与 Swarm/Agents SDK 选型
前置知识
一句话定义
主流多智能体框架的差异本质是控制流抽象的差异:LangGraph 把编排做成显式图(最强控制),AutoGen 把协作做成可编程对话(最快原型),CrewAI 把协作做成角色团队(最低门槛),OpenAI Agents SDK(Swarm 的后继)把协作做成轻量交接(最贴厂商生态);框架选型应发生在模式选型(kp-011)之后。
直观类比
框架是预制菜 vs 自备食材:图引擎像专业后厨(什么都能精确控制但要学),对话框架像火锅(食材下锅就有互动,快但火候难控),角色框架像套餐(搭配好了端上来),轻量 SDK 像便利店(够快,但选择跟着货架走)。
为什么重要
「先装框架再想架构」是多智能体项目的常见起点陷阱:框架的默认形态会悄悄替你做 kp-011 的选型。理解各框架的控制抽象与取舍,才能反过来「先定模式、再选框架」,并在框架不适配时敢于用裸代码(编排本质只是状态循环,kp-016)。
前置知识
kp-011(五种模式与选型决策链——框架是其执行载体);kp-016(编排谱系——各框架占据谱系的不同位置)。
核心概念:图谱对照表
| 框架 | 出品方 | 控制流抽象 | 强项 | 注意点 |
|---|---|---|---|---|
| LangGraph | LangChain | 显式图/状态机(kp-017) | 精细控制、持久化与检查点(kp-018)成熟、可视化 | 学习曲线陡;样板代码多 |
| AutoGen | 微软 | 可编程多智能体对话(Actor 模型,v0.4 起事件驱动) | 原型速度快;对话式协作表达自然;研究生态厚 | 版本更迭大;精细控制需进阶 API |
| CrewAI | 开源社区 | 角色团队 + 顺序/分层流程 | 上手最快;角色卡概念与 kp-005 天然对齐 | 控制粒度较粗;复杂图编排受限 |
| OpenAI Agents SDK | OpenAI | Handoffs 交接 + Guardrails(Swarm 实验项目的生产化后继) | 轻、贴合 OpenAI 生态;交接抽象与 kp-012 一致 | 生态绑定;复杂状态管理弱 |
| MetaGPT | 开源社区 | SOP 角色流水线(软件公司隐喻) | kp-007 模式的现成参考实现 | 偏演示与软件研发域 |
| AgentScope | 阿里 | 消息驱动 + 显式容错 | 分布式部署与容错设计突出 | 中文社区为主 |
| LlamaIndex Workflows | LlamaIndex | 事件驱动工作流 | 与 RAG 生态衔接顺滑 | 多智能体特性相对轻 |
(表格信息为写作时点的概括,各框架迭代很快,落地前以官方文档为准核对。)
原理与机制:选型的五个维度
- 控制粒度:需要条件路由、循环上限、自定义 reducer(kp-017/kp-019 的完整语义)→ 图型框架;只需「几个角色聊出结果」→ 对话型;
- 持久化与人机协同:生产系统需要检查点/中断审批(kp-018)→ LangGraph 的 checkpointer 最成熟;原型阶段可降级为无持久化;
- 可观测集成:团队已用某 tracing 工具(kp-025)→ 选原生集成好的框架;
- 锁定风险:轻量厂商 SDK 上手快但深度绑定其模型生态;开源框架模型无关但抽象层更厚;
- 团队熟悉度:比基准测试分数更决定交付速度的因素。
一条工程经验:原型用高抽象框架(CrewAI/AutoGen)验证协作价值,生产重构到强控制框架(LangGraph)或裸代码——原型期的需求是快,生产期的需求是控制与可观测,两者很少由同一工具最优满足。
实例或案例
同一个「客服多智能体」的两阶段选型:原型期用 CrewAI,三天搭出分流 + 两个专家智能体验证对话质量(此时没人知道这个功能值不值得做);验证通过进入生产,重构为 LangGraph——需要按 kp-018 加审批门、按 kp-022 接预算止损、按 kp-025 接公司现有 tracing 栈;Light 阶段曾考虑 Agents SDK,因需接内部非 OpenAI 模型而放弃。
公式或模型
本节不适用:框架选型无量化公式,五个维度的加权判断替代之(对比 kp-011 的结构选型同样无公式但有序)。
常见误区
- 误区一:框架排行榜决定选型。 基准分数不覆盖你的场景、团队与合规约束,五维度判断优先;
- 误区二:框架能力 = 系统能力。 防护栏、评估、治理(kp-022/024/026)都长在框架之外,换框架不解决它们;
- 误区三:必须用框架。 简单的两三步协作用裸代码循环更透明——框架省的是样板,不是思想。
与其他知识点的关系
本知识点是 kp-011 的下游(模式 → 框架)与 kp-028 的上游(框架 → 生产);kp-017/kp-018 的图与检查点概念在 LangGraph 中有最完整的对应实现。
自测题
- 四个主流框架各自的控制流抽象一句话概括?
要点:LangGraph 显式图/状态机;AutoGen 可编程对话(Actor);CrewAI 角色团队流程;Agents SDK 轻量 handoffs。
- 「原型用高抽象、生产用强控制」的理由?
要点:原型期要快(验证协作价值),生产期要控制与可观测(持久化/预算/tracing),两类需求的最优工具不同。
- 什么时候可以完全不用框架?
要点:两三步固定协作——裸代码状态循环即可,编排思想(kp-016)不依赖框架。
延伸阅读
各框架官方文档(按名称检索);Anthropic《Building Effective Agents》亦展示了「不用框架直接写」的路线,可与本图谱互为参照。