AI-Agent智能体清单与对比
·
AI Agent(智能体)清单与功能对比
更新时间:2026-07-31 | 语言:简体中文
说明:本文按智能体类别梳理主流 AI Agent 产品与框架,标注是否开源、官方网站及核心功能对比,并为每个智能体提供独立深度档案入口(档案涵盖:基础信息、核心设计思想、特性、典型模式、关键对比、优缺点、落地组合方案 七大部分)。数据基于 2026 年公开资料整理,请以各官网最新信息为准。
其中 AtomCode 与 OpenCode**:两者工具完全免费、开源,且都内置/支持免费 AI 模型,无需信用卡即可零成本体验 Agent 编程,适合个人学习与项目验证。
- AtomCode:CodingPlan 免费额度为限时活动(每日限量发放),领取后 30 天有效;
/login一条命令完成登录 + 申领 + 自动配置模型。 - OpenCode:工具本身免费,成本只取决于所接模型——接本地模型(Ollama)或免费档 API 即可零成本。
目录
一、分类总览
| 类别 | 定位 | 代表产品 | 开源代表 |
|---|---|---|---|
| 通用智能体产品 | 面向终端用户的综合 Agent(研究、浏览器操作、任务执行) | ChatGPT Agent / Operator、Manus、Claude Cowork | Hermes Agent、OpenClaw |
| 开源智能体框架 | 开发框架,构建自定义 Agent / 多智能体系统 | LangGraph、CrewAI、AutoGen、MetaGPT、OpenAI Agents SDK | 全部开源 |
| AI 编程智能体 | 代码编写、仓库级开发、自动提 PR | Cursor、Devin、GitHub Copilot、Claude Code | OpenHands、Aider、Cline、OpenCode |
| 浏览器 / 电脑操作智能体 | 模拟人类操作网页 / 桌面应用 | ChatGPT Operator、Perplexity Comet、字节 TARS | browser-use、OpenClaw |
| 国内智能体开发平台 | 中文生态、零/低代码搭建与分发 | 扣子 Coze、文心智能体、通义百炼、智谱清流 | Dify、FastGPT、AtomCode |
| 企业级智能体平台 | 企业工作流自动化、客服/办公场景 | Copilot Studio、Agentforce、n8n | n8n、Microsoft Agent Framework |
二、通用智能体产品(闭源为主)
面向终端用户的一站式智能体,可自主完成网页调研、数据分析、文件处理等多步骤任务。
| 名称 | 开发商 | 是否开源 | 官方网站 | 核心功能 | 突出优势 | 主要局限 | 一句话定位 |
|---|---|---|---|---|---|---|---|
| ChatGPT Agent(原 Operator) | OpenAI | ❌ 闭源 | openai.com | 浏览器自主操作、订票/填表/购物、Agent 模式内置于 ChatGPT | 消费级浏览器自动化体验最好;随 Pro 订阅($200/月)提供 | 桌面任务(OSWorld 仅 38.1%)弱;遇验证码/2FA 易失败 | 浏览器事务自动化(订票/购物/填表) |
| ChatGPT Atlas | OpenAI | ❌ 闭源 | openai.com | 浏览器深度研究、自主浏览执行 | 研究类任务强,Agent 模式下直接使用 | 后台自动执行存在误操作/交易风险(MIT 研究提示) | 深度研究 + 浏览器执行一体 |
| Claude Cowork | Anthropic | ❌ 闭源 | anthropic.com/claude | 知识工作协作(文档、表格、数据分析、浏览器) | 长任务可靠、与 Claude Code 打通;随付费套餐提供 | 生态锁定 Anthropic 系模型 | 知识工作协作,与 Claude Code 打通 |
| Gemini(Project Mariner 等) | ❌ 闭源 | gemini.google.com | 浏览器操作、多模态 Agent 任务 | 与 Google 搜索/Workspace 生态深度集成 | 主要面向 Google 生态 | 多模态底座 + Mariner 浏览器操作 | |
| Hermes Agent | Nous Research | ✅ 开源(Apache 2.0) | github.com/NousResearch | 开源终端智能体、工具调用、多智能体编排 | 可本地部署、无厂商锁定 | 生态和易用性不如闭源商业产品 | 开源终端智能体,可本地部署 |
| Manus 1.5 | Butterfly Effect(蝴蝶效应) | ❌ 闭源(原开源方案已下架) | manus.im | 长时程自主研究、端到端交付(报告/表格/网站) | GAIA 基准领先(L2 70.1%);"定目标后放手"体验最佳 | 积分计费($19/$199 档)成本难控;底层依赖 Claude 模型 | 长时程自主研究、端到端交付物 |
| Devin 2.0 | Cognition | ❌ 闭源 | devin.ai | 软件工单自动处理(Ticket→PR)、云端沙箱开发 | 零接触工单处理最强 | 价格高(约 $500/月),仅适用开发场景 | —(详见四、AI 编程智能体) |
对比要点
- 可靠性与易用性:Claude Agent 系在知识工作/编码场景整体最稳;ChatGPT Agent 在消费浏览器场景体验最好。
- 自主性:Manus 的"目标→放手→交付物"模式最接近 AGI 式任务代理,但按积分计费、成本不可控。
- 通用性 vs 专用性:行业共识是"窄 Agent 优于宽 Agent"——按场景选择专用工具(研究选 Manus/Atlas,编码选 Claude Code/Devin,浏览器选 Operator)。
- 开源替代:Hermes Agent、OpenClaw 是主要开源备选,但成熟度与商业产品有差距。
三、开源智能体框架
用于开发自定义智能体的底层框架,绝大多数 MIT/Apache 2.0 许可,成本主要来自 LLM API 调用。
| 名称 | 开发商 | 是否开源 | 官方网站 | 核心功能 | 突出优势 | 主要局限 | 编排范式 |
|---|---|---|---|---|---|---|---|
| LangChain / LangGraph | LangChain Inc. | ✅ 开源(MIT) | langchain.com | Agent 编排、600+ 集成、图状态机工作流 | 生态最大(100K+ stars)、生产级、灵活度最高 | 学习曲线陡、依赖重(~100 个依赖包) | 图/状态机 |
| CrewAI | CrewAI Inc. | ✅ 开源(MIT) | crewai.com | 角色化多智能体协作(研究员/写手/分析师) | 10 分钟上手、声明式 Crew 定义、企业落地多 | 深层调试困难、运行间记忆有限 | 角色化协作 |
| AutoGPT | Significant Gravitas | ✅ 开源(MIT) | agpt.co | 开放式自主目标执行、实验性研究 | 概念开创者、探索性任务强 | 易循环烧 token、维护活跃度下降 | 开放式自主循环 |
| MetaGPT | 深势科技(FoundationAgents) | ✅ 开源(MIT) | github.com/FoundationAgents/MetaGPT | 模拟软件公司(PM/架构师/工程师/QA) | 单提示词生成结构化软件交付物、MVP 规格生成强 | 简单任务上"杀鸡用牛刀" | 软件公司模拟 |
| AutoGen / Microsoft Agent Framework | Microsoft | ✅ 开源(MIT) | github.com/microsoft/autogen | 会话式多智能体、事件驱动编排 | 与 Azure 生态集成、学术与工业应用多 | 演进方向多次调整(AG2/Framework) | 会话式/事件驱动 |
| OpenAI Agents SDK | OpenAI | ✅ 开源(MIT) | openai.github.io/openai-agents-python | 轻量 Agent 原语、Handoffs 多 Agent 切换 | 轻量简单、官方维护、上手快 | 深度场景需自建编排 | 轻量原语 + Handoffs |
| Pydantic AI | Pydantic | ✅ 开源(MIT) | ai.pydantic.dev | 类型安全 Agent、结构化输出 | 类型安全最佳、轻量、无厂商锁定 | 功能范围小于全量框架 | 类型安全 |
| LlamaIndex | LlamaIndex | ✅ 开源(MIT) | llamaindex.ai | RAG 优先的 Agent 开发、数据框架 | RAG/知识检索最强 | Agent 编排能力弱于 LangGraph | RAG 优先 |
| Letta | Letta Inc. | ✅ 开源(Apache 2.0) | letta.com | 带记忆的 Agent、上下文自动压缩 | 唯一提供自动上下文压缩的框架 | 生态较小 | 记忆 + 上下文压缩 |
| Google ADK | ✅ 开源(Apache 2.0) | google.github.io/adk-docs | 多智能体编排、与 Gemini 生态集成 | 官方支持、代码质量高 | 社区规模小于 LangChain | 多智能体层级编排 | |
| n8n | n8n GmbH | ✅ 开源(fair-code) | n8n.io | 工作流自动化 + AI Agent 节点、自托管 | 流程集成强、可视化、可私有化 | 非纯 Agent 框架,复杂编排受限 | 可视化工作流 + Agent |
对比要点
- 编排范式:图/状态机(LangGraph、ADK)→ 复杂生产流程;角色化(CrewAI)→ 团队式任务;会话式(AutoGen)→ 对话协作;开放式(AutoGPT)→ 探索研究。
- 生态与健康度:LangChain 是共享基础设施,吸引 82.5% 跨生态贡献者;AutoGPT 星数高但贡献者密度低(星数≠活跃度)。
- MCP 支持:主流框架均已支持 MCP(Model Context Protocol),已成为工具接入事实标准。
- 生产落地:企业生产首选 LangGraph/CrewAI/ADK;研究实验可选 AutoGPT/MetaGPT;类型安全与轻量场景选 Pydantic AI / OpenAI Agents SDK。
四、AI 编程智能体
覆盖"终端结对编程 → IDE 内编辑 → 全自动开发"三个层次。
| 名称 | 开发商 | 是否开源 | 官方网站 | 核心功能 | 突出优势 | 主要局限 | 形态 |
|---|---|---|---|---|---|---|---|
| Claude Code | Anthropic | ❌ 闭源(CLI 可用) | anthropic.com/claude-code | 终端原生编码 Agent、仓库级重构、MCP | 最受开发者喜爱(46% 好评)、年化收入 $10 亿级 | 仅限 Anthropic 模型、费用较高 | 终端 |
| Cursor | Anysphere | ❌ 闭源 | cursor.com | IDE 嵌入式多文件编辑、Composer Agent | IDE 内多文件协作体验最佳 | 基于 VS Code 分支、模型按量计费 | IDE |
| GitHub Copilot | GitHub / Microsoft | ❌ 闭源 | github.com/features/copilot | IDE/CLI 补全与 Agent 模式 | 生态接入最广、企业合规支持好 | Agent 深度弱于专用编码 Agent | IDE + CLI |
| Windsurf | Codeium | ❌ 闭源 | windsurf.com | IDE Agent 编码、Cascade 多步操作 | 定价灵活、体验接近 Cursor | 市场份额被 Cursor 挤压 | IDE |
| Devin | Cognition | ❌ 闭源 | devin.ai | 云端自动开发、Ticket→PR | 零接触自动化最强 | 贵($500/月)、非交互式场景最佳 | 云端全自动 |
| OpenHands(原 OpenDevin) | All Hands AI | ✅ 开源(MIT) | all-hands.dev | 自主修 Issue→PR、Docker 沙箱、CodeAct | 开源最强 SWE-bench(~72%)、100+ 模型供应商 | 部署重(需 Docker)、本地小模型效果差 | 云端沙箱自主 |
| Aider | Aider 社区 | ✅ 开源(Apache 2.0) | aider.chat | Git 原生结对编程、diff 补丁式编辑、自动提交 | 单次会话 token 成本最低、最轻量 | 开发节奏放缓、本地模型需 ≥32B | 终端(git 原生) |
| Cline | Cline | ✅ 开源(Apache 2.0) | cline.bot | VS Code/JetBrains 内多文件编辑、Plan/Act 双模式、MCP | IDE 内审批式操作最安全、460 万+ 安装 | 大仓库任务 token 消耗高(单任务 50 万+ tokens) | IDE(审批式) |
| OpenCode | SST | ✅ 开源(MIT) | opencode.ai | 终端 TUI 编码 Agent、多模型 | 开源社区增长最快(~165K stars) | 功能仍在快速演进 | 终端 TUI |
| Codex CLI | OpenAI | ✅ 开源(Apache 2.0) | github.com/openai/codex | 终端编码 Agent、200 万+ 周活 | OpenAI 官方 CLI、与 ChatGPT 联动 | 深度依赖 OpenAI 模型 | 终端 |
| Roo Code | Roo Code Inc. | ✅ 开源(Apache 2.0) | github.com/RooCodeInc/Roo-Code | Cline 分支,自定义模式、分层任务 | 可配置性强、社区活跃 | 稳定性略逊 Cline | IDE(Cline 分支) |
对比要点
- 形态选择:IDE 内(Cursor/Cline)适合交互式多文件开发;终端(Claude Code/Aider)适合 git 原生工作流;云端(Devin/OpenHands)适合无人值守工单。
- 开源 vs 闭源:闭源商用体验最好但贵且锁定模型;开源可自部署、换模型,SWE-bench 已追上(OpenHands ~72% vs Claude Code 顶级配置 ~70%+)。
- 成本:Aider 最低 token 消耗;Cline 审批流安全但大仓库 token 高;Claude Code 模型费用贵但效率高。
- 安全:审批式(Cline 的 Plan/Act、Cursor)适合对代码变更敏感的场景。
五、浏览器 / 电脑操作智能体
模拟人类操作网页与桌面应用,完成订票、填表、数据采集等任务。
| 名称 | 开发商 | 是否开源 | 官方网站 | 核心功能 | 突出优势 | 主要局限 | 操作范围 |
|---|---|---|---|---|---|---|---|
| ChatGPT Operator | OpenAI | ❌ 闭源 | openai.com/operator | 网页自主操作(购物、订票、填表) | WebVoyager 87%、消费者场景体验佳 | 桌面操作弱(OSWorld 38.1%)、验证码易卡 | —(详见二、通用智能体产品) |
| ChatGPT Atlas | OpenAI | ❌ 闭源 | openai.com | 深度研究 + 浏览器执行 | 长时程研究任务强 | 后台自动执行有误操作风险 | —(详见二、通用智能体产品) |
| Manus | Butterfly Effect | ❌ 闭源 | manus.im | 网页 + 电脑操作的综合任务代理 | 任务完成度与交付物质量领先 | 积分计费、长任务不稳定 | —(详见二、通用智能体产品) |
| Perplexity Comet | Perplexity | ❌ 闭源 | perplexity.ai/comet | 自主浏览器研究代理 | 研究/资料搜集场景体验好 | 交易类任务能力有限 | 浏览器研究 |
| TARS | 字节跳动 | ❌ 闭源 | tars.byteplus.com | 浏览器 + 电脑操作(开源了部分模型) | 多模态操作、中文场景支持好 | 数据走字节云 | 浏览器 + 桌面 |
| browser-use | browser-use | ✅ 开源(MIT) | github.com/browser-use/browser-use | Python 驱动的浏览器自动化 Agent | 开源主流方案、与 LangChain 集成 | 需自己接模型、稳定性依赖模型 | 浏览器(Python 库) |
| OpenClaw | OpenClaw 社区 | ✅ 开源(MIT) | github.com/openclaw/openclaw | 电脑/浏览器全栈操作(原 Claude-Computer-Controller 系) | 开源电脑操作主力、可本地部署 | 有后台自动执行的误操作风险 | 浏览器 + 桌面全栈 |
对比要点
- 两大路线:闭源托管(Operator/Manus/Comet)开箱即用;开源(browser-use/OpenClaw)自部署可控。
- 基准水平:Web 任务(WebVoyager/WebArena)普遍较好,桌面任务(OSWorld)全线偏弱——复杂的桌面自动化仍是短板。
- 安全风险:MIT CSAIL 将"后台执行 + 直接交易"类代理(Atlas、TARS、Comet)列为高风险,建议限定权限与交易确认。
六、国内智能体开发平台
中文生态的零/低代码智能体搭建与分发平台,2026 年 IDC 报告显示私有化市场规模约 17.5 亿元。
| 名称 | 开发商 | 是否开源 | 官方网站 | 核心功能 | 突出优势 | 主要局限 | 定位 |
|---|---|---|---|---|---|---|---|
| 扣子 Coze | 字节跳动 | ❌ 闭源 | coze.cn(国际版 coze.com) | 零代码搭建、800+ 插件、一键分发豆包/飞书/微信 | 上手最快(15 分钟)、免费额度慷慨(个人 500 次/天) | 不支持私有化、多 Agent 协作弱、绑定豆包模型 | 零代码 + 一键分发 |
| Dify | 语灵 LangGenius | ✅ 开源(Apache 2.0) | dify.ai | LLMOps 平台、RAG 工作流、Agent 编排 | 横评第一:可私有化、RAG 最强、200+ 模型热插拔(50K+ stars) | 学习曲线较陡、企业功能(SSO/审计)需付费版 | LLMOps / RAG / 私有化 |
| 文心智能体平台 | 百度 | ❌ 闭源 | agents.baidu.com(千帆 qianfan.cloud.baidu.com) | 零代码搭建、百度搜索流量分发 | 中文语义理解强、政务/国企案例多 | 产品线多易混淆、免费额度有限 | 零代码 + 搜索分发 |
| 通义百炼 | 阿里云 | ❌ 闭源 | bailian.aliyun.com | 企业级 MaaS + Agent、钉钉一键发布 | 电商场景强(淘宝客服/1688 助手)、阿里云生态打通 | 绑定阿里云生态、控制台门槛高 | 企业级 MaaS + Agent |
| 智谱清流(清言) | 智谱 AI | ❌ 闭源(模型部分开源) | chatglm.cn | GLM 模型同源 Agent 平台 | 工具调用稳定、价格亲民、学术背景强 | 生态不如大厂、企业级功能待完善 | GLM 同源端到端 |
| 腾讯云 ADP | 腾讯云 | ❌ 闭源 | cloud.tencent.com/product/adp | 企业级 Agent 开发与编排 | 腾讯生态(企微/腾讯会议)集成、公有云前三 | 面向企业,个人门槛高 | 企业级编排 |
| 火山引擎 HiAgent | 火山引擎 | ❌ 闭源 | volcengine.com/product/hiagent | 企业智能体开发平台 | 私有化市场第一、与豆包/飞书联动 | 需火山生态 | 企业级(私有化第一) |
| 讯飞星辰 | 科大讯飞 | ❌ 闭源 | xingchen.xfyun.cn | 星火大模型 Agent 平台 | 语音/教育行业场景强 | 生态相对封闭 | 语音/教育 |
| 蚂蚁 Agentar | 蚂蚁集团 | ❌ 闭源 | agentar.com | 智能体开发平台 | 金融场景强(支付/风控)、私有化前五 | 行业属性强,通用性一般 | 金融场景 |
| FastGPT | FastGPT 社区 | ✅ 开源(Apache 2.0) | fastgpt.in | 知识库问答 + 简单工作流 Agent | 国内开源社区热、知识库场景易上手 | 复杂编排能力弱于 Dify | 知识库问答 + 工作流 |
| 原子 AtomCode | AtomGit(开放原子开源基金会 + CSDN) | ✅ 开源(MIT) | atomcode.atomgit.com | 终端 AI 编程智能体(Claude Code 开源平替)、自主读改测 | 模型中立(任意 OpenAI 兼容 API)、Rust 跨平台 | 生态成熟度待提升、终端形态门槛高 | 开源终端编程智能体 |
对比要点
- 选型逻辑:无技术团队 → 扣子 Coze / 文心智能体(零代码 + 流量分发);数据不能出域 / 需私有化 → Dify / FastGPT(唯一成熟开源路线);云生态绑定 → 百炼(阿里)/ 千帆(百度)/ HiAgent(字节);政务知识密集 → 百度千帆 / 智谱清流。
- 市场格局(IDC 2025 数据):私有化前五为火山 HiAgent、腾讯 ADP、阿里百炼专属版、蚂蚁 Agentar、电信 AI;公有云前三为扣子、千帆、腾讯 ADP。
- 趋势:开源平台(Dify/FastGPT)快速追赶;"扣子/Dify 搭智能体 + n8n/Make 做流程集成"的混合架构成为主流。
七、企业级智能体平台
面向企业的自动化工作流与办公智能体平台。
| 名称 | 开发商 | 是否开源 | 官方网站 | 核心功能 | 突出优势 | 主要局限 | 定位 |
|---|---|---|---|---|---|---|---|
| Microsoft Copilot Studio | Microsoft | ❌ 闭源 | microsoft.com/copilot-studio | 低代码智能体、M365/Teams 集成 | 与 Office 生态无缝、企业合规完善 | 绑定微软生态、国内访问受限 | M365/Teams 办公 |
| Salesforce Agentforce | Salesforce | ❌ 闭源 | salesforce.com/agentforce | 客户服务/销售自动化 Agent | CRM 场景最强、预置行业 Agent | 仅限 Salesforce 生态、费用高 | CRM 销售/客服 |
| ServiceNow AI Agents | ServiceNow | ❌ 闭源 | servicenow.com | IT 运维/工单自动化 Agent | ITSM 场景深度集成 | 垂直场景 | ITSM/ITOM |
| n8n | n8n GmbH | ✅ 开源(fair-code) | n8n.io | 可视化工作流 + AI Agent 节点、自托管 | 流程编排灵活、可私有化 | 需自运维 | —(详见三、开源智能体框架) |
| Microsoft Agent Framework | Microsoft | ✅ 开源(MIT) | github.com/microsoft/agent-framework | 跨语言(Python/.NET/JS)Agent 开发 | 统一 API、与 AutoGen/Azure AI Foundry 联动 | 仍较新、社区待壮大 | 跨语言开发框架 |
对比要点
- 企业选型核心看已有生态:微软系 → Copilot Studio;CRM/销售 → Agentforce;ITSM → ServiceNow;要自托管 + 流程自动化 → n8n。
- 开源企业级方案以 n8n + Dify + LangGraph 组合为主流。
八、选型建议
按身份选择:
| 使用者 | 推荐 |
|---|---|
| 终端用户(研究/日常) | ChatGPT Agent、Perplexity Comet、Manus |
| 开发者(编码) | 交互式:Cursor / Cline;终端:Claude Code / Aider;自动化:Devin / OpenHands |
| 开发者(框架选型) | 生产编排:LangGraph / CrewAI / Google ADK;轻量:Pydantic AI / OpenAI Agents SDK |
| 企业(私有化) | Dify + n8n(开源组合)或对应云厂商专属版 |
| 中文业务团队(无代码) | 扣子 Coze、文心智能体平台 |
核心结论:
- 没有"最好的 Agent",只有"最合适的场景"——窄而专的 Agent 普遍优于通用 Agent。
- 开源 vs 闭源:闭源体验与生态占优、成本高且锁定;开源可自部署、换模型、免订阅费,代价是运维与调优成本。
- 成本注意:闭源 Agent 多按订阅或积分计费(Manus 积分、Claude Code 模型费);开源框架成本主要为 LLM API 调用。
- 安全:涉及交易/后台执行的 Agent 务必限定权限与人工确认环节。
- 快速迭代领域请以官网为准。
⚠️ 注:AI Agent 领域迭代极快,上表信息截至 2026-07;开源状态、定价与基准数据请以官网及 GitHub 仓库最新信息为准。
更多推荐

所有评论(0)