盘点目前流行的AI Agent,哪个更适合新手入门?
上篇结尾我说过,后篇给大家介绍目前主流的智能体。这几天一直有朋友来问,说想入门 AI Agent,看网上文章看得眼花缭乱,到底该从哪一款下手。
今天就趁热打铁,把市面上讨论度最高的七款拉出来盘一遍,分别是:Claude Code、Codex、OpenClaw、Hermes、WorkBuddy、ZCode、Trae。
每款我会从出品方、推出时间、开不开源、能不能接第三方 API、是桌面软件还是命令行、国内安装麻不麻烦这几个角度讲清楚,再结合网上大家真实的反馈说说优点和缺点,最后综合所有信息,告诉你们哪款最适合小白入门。
先说来个总的认识,这七款虽然都叫 AI Agent,但分两类:一类是给你写代码用的编程 Agent,Claude Code、Codex、ZCode、Trae 基本都属于这类。另一类是帮你干活的通用个人助手,OpenClaw、Hermes、WorkBuddy 属于这类。
一、Claude Code
- 出品方:Anthropic
Claude Code 是 Anthropic 公司出的,就是做 Claude大模型那家美国公司。2025 年 2 月发布,算是这波 AI 编程 Agent 浪潮里最早的几个之一,现在很多同类工具都是照着它的路子做的。
- 是否开源:核心代码不开源。
虽然 GitHub 上有官方仓库,但主要是放文档和发 issue 用的,没有开源许可证。功能上它是在终端里干活,你打开命令行,用自然语言交代任务,它就能自己读代码、改文件、跑测试,跨文件做大重构特别
强,200K 上下文,一次能塞进整个项目的关键部分。社区公认它的效率上限是同类里最高的。
- 是否支持第三方API:支持接第三方 API。
国内很多人用环境变量把它的模型地址指到 DeepSeek、通义千问、智谱 GLM 这些国产模型上,也可以通过类似cc switch工具来实现。
- 运行形态:运行形态以命令行为主
claude code运行形态以命令行为主,后来也出了 VS Code、JetBrains 的插件和桌面版、网页版。
- 安装难易程度 中等偏难。
难不在装软件本身,一条命令就装好了,难在账号和付费,注册 claude.ai 要海外手机号,订阅 Pro 大概 20 美元一个月,网络还得自己想办法,当然不想折腾的可以用国产模型 API绕过去。
优点:重构和跨文件修改能力碾压级,边改边跑测试很稳。代码审查、调试、生成单元测试是它的杀手锏。装起来简单、资源占用低。CLAUDE.md 项目记忆功能好用,团队工作流可以沉淀下来。
缺点 :没有代码补全,日常边写边补的体验差,写小段代码效率反而不高。学习曲线陡,要习惯终端操作、会写高质量提示词。20 美元的订阅档限流很紧,重度使用得买100美元的 Max档。纯终端界面看图能力弱,设计稿转代码还原度一般。国内用还要先解决账号、支付、网络三道坎。
二、Codex
- 出品方:OpenAI
Codex 是 OpenAI 出的,就是做 ChatGPT 那家公司。这里要注意,2021 年有个老 Codex 是 GitHub Copilot 的前身,早退役了,2025 年 4 月这个新版是完全不同的产品,是自主编码 Agent。
- 是否开源:命令行版开源,其余闭源。
Codex 的开源情况比较特别,命令行版是开源的,Apache-2.0 协议,GitHub 上 10 万多 star,但是云端版、桌面版、IDE 插件和底层模型都是闭源的。
- 是否支持第三方API:支持。
它也支持接第三方 API,在配置文件里可以自定义模型服务商,指向任意 OpenAI 兼容的网关。
- 运行形态:命令行、桌面应用、IDE 插件、网页端全覆盖。
运行形态是这几款里最全的,桌面版有中文界面,操作逻辑和 ChatGPT 差不多,对新手挺友好,还能手机远程控制、在应用里操作电脑。
- 安装难易程度:中等偏难。
难在账号和付费,注册要 ChatGPT 付费账号,完整功能要 200 美元一个月的 Pro 档才放得开,api.openai.com 直连还不稳定。
优点:异步并行批量任务强,可以同时扔几十个任务让它自动改代码、自动提 GitHub PR,开个会回来收 PR就行。和 GitHub 集成深,适合流水线自动化。桌面版对新手友好,不想碰终端的可以先用它过渡。和 GPT系列模型配合最顺。
缺点:没有实时交互,不能边写边调,日常心流编码体验差。完整功能绑死 200 美元的 Pro 订阅,太贵。依赖云端沙箱执行,网络受限的环境用起来尴尬。自动生成的 PR 质量忽高忽低,必须人工审查。官方文档部分页面国内访问受限,资料主要靠民间教程。
三、OpenClaw
- 出品方:个人开发者 Peter Steinberger 发起,现由非营利组织 OpenClaw Foundation 主导。
OpenClaw 这名字看着眼生,但说它的原名 Clawdbot,玩 AI 的人基本都听说过。吉祥物是一只太空龙虾,中文社区管部署它叫“养龙虾”,你们上篇应该见过这个梗。它的故事挺戏剧化,仓库 2025 年 11 月创建,2026 年 1 月突然爆火,然后 1 月 27 日凌晨收到 Anthropic 的商标律师函,说 Clawdbot 和 Claude 太像,当天紧急改名 Moltbot,1 月 30 日正式定名 OpenClaw。现在 GitHub 上 38.5 万 star、8 万 fork,是这七款里星数最高的,也是全球开源项目里数得着的顶流。
- 是否开源:MIT 协议开源。
TypeScript 写的。它能真正操作你的电脑,管理文件、控制浏览器、发消息、写代码,还能通过 WhatsApp、Telegram、Discord、微信这些渠道手机远程指挥它干活,装到 VPS 上就能 7×24 小时在线。
- 是否支持第三方API:支持。
第三方 API 支持非常开放,Anthropic、OpenAI、Google、阿里云百炼都能接,还支持 vLLM、Ollama 这些本地模型,想接 DeepSeek、GLM 也有现成路子。
- 运行形态:命令行加 Web 控制台,能操作本机,也能手机远程指挥。
CLI 是主形态,配套有 Windows、macOS 的应用和手机 App,消息渠道能接 WhatsApp、Telegram、Discord、微信等 30 多个。
- 安装难易程度:中等。
官方有一键安装脚本,但托管在海外域名,国内网络可能慢,好在中文社区做了镜像站和一堆保姆级教程。配置模型要 API key,海外模型的 key 要海外支付,用国产模型或中转能解决。
优点:开源免费、本地部署、数据私密。是真的能干活,不是只会聊天。多平台接入,手机随时指挥。模型随便换,没有厂商锁定。一键脚本安装,对非开发者算友好。Skills 插件生态活跃,社区热度极高。
缺点:依赖 Node.js 环境和命令行操作,纯小白有门槛。海外模型 API key 获取和付费麻烦,国内要折腾中转或国产模型。被商标律师函改名的事让一些人担心项目稳定性。Agent 有本机操作权限,误操作风险要自己把控,官方自己都说能力很强、风险也很大。官方文档以英文为主,中文资料比较碎。
四、Hermes
- 出品方:Nous Research。
Hermes 是 Nous Research 出的,一家美国 AI 研究机构,就是开源 Hermes 系列大模型那个团队。仓库 2025 年 7 月创建,2026 年 6 月推出官方桌面版,现在 GitHub 上 22.6 万 star。
- 是否开源:MIT 协议开源。
Python 写的。它的定位是自托管的个人 AI Agent 框架,能力很全面,终端、浏览器、文件操作、定时任务、子 Agent 委派都有,还独有一个学习闭环,会自动沉淀技能、跨会话长期记忆,越用越懂你。
- 是否支持第三方API:支持。
第三方 API 支持是七款里最夸张的,官方宣称 300 多个模型,DeepSeek、GLM、Kimi、MiniMax 这些国产的都在列,OpenRouter 上 200 多个模型随便换,还能接本地 Ollama、LM Studio,一条命令切换,没有任何厂商锁定。
- 运行形态:命令行为主,有桌面版,消息网关丰富。
运行形态核心是命令行,桌面版出来后友好多了,消息网关可以接 Telegram、微信、飞书、企业微信这些,手机遥控很方便。
- 安装难易程度:中等。
官方安装脚本走 curl 管道,国内网络不稳,中文社区做了加速镜像,模型用国产 API 就行,不需要海外支付,整体比 OpenClaw 稍友好一点。
优点:开源免费、自托管、数据不出本机。学习闭环是独门绝技,越用越聪明。模型随便切换,支持国产和本地模型。消息网关多,手机遥控方便。能力全面,轻量,官方说 5 美元的 VPS 就能跑长期在线。
缺点:默认还是命令行,对小白不友好,桌面版 2026 年 6 月才出。官方文档英文为主,中文靠社区维护。国内官方安装链路不稳,要用社区镜像。功能配置项多,上手学习成本偏高。自主执行工具有安全边界问题,权限要自己配。
五、WorkBuddy
- 出品方:腾讯云。
WorkBuddy 是腾讯云出的,和腾讯的代码工具 CodeBuddy 同属一个产品家族。2026 年 1 月内部开放体验,2 月开放公测申请,3 月 13 日正式商用上线。
- 是否开源:闭源商业产品。
但这个不重要,因为它面向的压根不是程序员,而是不会写代码的普通职场人。口号是“AI Agent 办公新范式”,你直接用大白话交代任务,它就能读写本地文件、编辑 Excel 和 Word、批量重命名压缩、自动出图表做 PPT,纯自然语言操作,零代码门槛。
- 是否支持第三方API:支持。
内置混元、DeepSeek、Kimi、GLM 这些主流模型,也能填 Base URL 和 Key 接任意 OpenAI 兼容接口,还支持 Ollama 本地模型。
- 运行形态:桌面应用加手机 App,有云端托管。
Windows、macOS 桌面应用是主形态,还有 iOS、Android、鸿蒙三端 App 和微信小程序,最关键的是有云端任务托管,关掉客户端任务还能继续跑,手机微信发指令就能远程遥控电脑干活。
- 安装难易程度:容易。
官网下载安装包,微信或 QQ 扫码登录,国内直连不用翻墙,新用户送免费体验积分。付费是积分制,用完了可以买加量包,或者订个人版套餐,标准版一个月大概 4000 积分。
优点:真能动手干活,不是只会聊天,直接编辑文件、出图表做 PPT。纯自然语言、零代码门槛,就是给 HR、运营、行政、产品这些非技术岗位设计的。多模型自由切换,还有 100 多个预置领域专家和 SkillHub 技能市场。云端 7×24 托管加远程遥控,通勤出差都能跟进。多 Agent 并行协同,团队流程可以沉淀复用。腾讯系出品,安全合规和权限控制做得好,企业接受度高。
缺点:复杂任务容易理解跑偏,需求模糊、多文件嵌套的逻辑经常执行结果不符合预期。执行不够稳定,大文件处理慢、Excel 复杂公式容易崩、多步骤任务会中途断掉。积分制消耗快,免费额度很快就用完,不充值没法重度使用。超复杂的业务逻辑和专业决策做不了,只能干标准化体力活。本地文件操作有权限风险,指令写错可能删错文件。PPT 和设计类能力较弱,排版丑,只能当快速草稿用。
六、ZCode
- 出品方:智谱 AI。
ZCode 是智谱 AI 出的,就是做 GLM 大模型那家国内公司。早期版本 2026 年初上线,2026 年 6 月 13 日发布 3.0 大版本,和开源旗舰模型 GLM-5.2 同一天发布,深度适配 GLM-5.2,中文社区直接叫它“国产版 Codex”。到现在 3.6.5,保持每周发版。
- 是否开源:应用层闭源,但适配的模型开源。
它适配的 GLM-5.2 模型本身是开源的,MIT 协议,754B 参数、1M 上下文,登顶过代码盲测榜单,社区说的“开源”大多指模型。
- 是否支持第三方API:支持。
官方有 GLM Coding Plan 订阅,也能自定义模型服务商,实测可以接 DeepSeek V4 这些。2.x 时代还能调度 Claude Code、Codex 的外部工具,3.0 起聚焦自研内核了。
- 运行形态:桌面应用。
Windows、macOS、Linux 都有安装包,界面极简,IDE 加终端风格,改文件、跑命令、调工具都在一个界面里,还能 SSH 连远程服务器干活,长任务在远端跑不用守着。另有微信公众号移动端入口,不用单独装 App。
- 安装难易程度:容易。
官网下载即装即用,手机号注册登录,国内直连,但免费额度有限,新用户送 GLM-5.2 体验,持续用要买 Coding Plan 或自备 API key。
优点:GLM-5.2 原生深度适配,1M 真实可用上下文能装下整个工程,长程任务稳定,中文场景和大代码库分析优势明显。界面极简、零学习成本,对话即执行。能一键安装 Claude Code、Codex 这些第三方编程工具并统一管理 API key。SSH 远程操作,长任务远端稳定执行。多模型切换方便,对比 Claude Code 能解决卡死问题。迭代极快,每周发版,定时任务、自动化、飞书机器人都在加。
缺点:办公能力偏弱,写文档、做 PPT、搞汇报不是它的菜。免费额度有限,注册福利用完基本不够用,重度使用必须订阅或自备 key。后台 token 统计不准,记录用量和实际消耗对不上。有评测说它界面 1:1 复刻 Cursor,还列了三大硬伤。3.0 之前依赖调度第三方 CLI 工具,自研生态还在建设中。订阅价格不低,Pro 档大概 430 元一个月。
七、Trae
- 出品方:字节跳动。
Trae 是字节跳动出的,2025 年初推出,是国内 AI 编程工具里普及度最高的之一。2026 年产品线升级成 TRAE Work,分 Work、Code、Design 几个模式,但核心还是 AI IDE。
- 是否开源:闭源商业软件。
国内版长期免费,字节算力补贴,国际版有 Free 和 Pro 两档,Pro 大概 10 美元一个月。
- 是否支持第三方API:支持。
设置里能配 API key 接豆包、OpenAI、Anthropic 这些,国内版内置豆包和 DeepSeek 系列免费无限用,国际版原生接 Claude、GPT、Gemini,注意 Claude 在国内港澳不可用。
- 运行形态:桌面 IDE。
基于 VS Code 内核二次开发,能一键导入 VS Code、Cursor 的插件、设置和快捷键,迁移成本极低。核心功能是智能问答、Builder 自然语言生成完整项目和智能补全,Builder 模式说一句需求就能帮你建目录、写代码、装依赖、跑预览,对新手特别友好。
- 安装难易程度:最容易。
官网下载安装包,双击安装一两分钟搞定,手机号或稀土掘金账号登录就能用,国内直连不用代理,内置国产模型免费,不用海外支付也不用碰命令行。
优点:国内直连、完全免费、全中文界面,不用魔法上网。内置豆包和 DeepSeek 模型免费无限调用,也支持自定义 key 接 Claude、GPT。基于 VS Code 内核,一键导入插件配置快捷键,迁移成本极低。Builder 模式用自然语言生成完整项目,新手友好。安装上手门槛最低,教程资源丰富。生态已经做大了,把 IDE、Agent、办公场景都打通了。
缺点:模型能力天花板不如 Cursor、Claude Code,复杂任务表现有差距。国内版默认只有豆包、DeepSeek 这些国产模型,用 Claude、GPT 要自己配 key。国际版高级功能按 token 计费,免费档受限。闭源软件,插件生态不如 Cursor 丰富,深度定制受限。部分历史版本有稳定性和中文模型幻觉的问题反馈。
八、七款横向对比
七款讲完了,信息有点多,我按上面的维度做了张对比图,一眼就能看明白。

从图里能看出来,开源和模型自由这块,OpenClaw 和 Hermes 是最彻底的,MIT 协议,代码随便看,模型随便换。国产三款装起来最容易,扫码或手机号登录就能用。血统最正的 Claude Code 和 Codex,门槛也最高,账号、支付、网络三座大山。
九、哪款最适合新手入门
综合网上这么多反馈,我的结论分情况说。
如果你是完全不会写代码的普通人,就想让 AI 帮你干办公的活,处理文档、做表格、整理资料、生成 PPT,那 WorkBuddy 是最适合入门的。
它零代码门槛,扫码登录说人话就开工,国内直连不用翻墙,腾讯出品安全合规也放心,就是积分制要花钱,但入门体验是够的。
如果你想学编程、写代码,想让 AI 帮你写程序,那 Trae 是最适合入门的。下载即用、中文界面、免费无限用国产模型,Builder 模式说句话就生成整个项目,完全不用碰命令行,是国内新手学 AI 编程的第一站。等用熟了,再考虑要不要升级到 Claude Code、Codex 这些上限更高的工具。
如果你想玩开源、折腾自己部署、追求数据私密和模型自由,那从 Hermes 入手比 OpenClaw 稍微平缓一点,两者都是 MIT 开源,都能接国产模型,但都要会一点命令行,属于进阶新手的玩具。我对开源有一种执着,也比较喜欢折腾,所以我选了Hermes。
至于 Claude Code 和 Codex,我不建议纯小白一上来就碰。不是说它们不好,恰恰相反,它们是效率上限最高的,但门槛也最高,账号、支付、网络、命令行、提示词,哪一样对新手都不友好。等你在 Trae 或 ZCode 上练熟了,再来上手它们,会顺畅得多。
一句话总结:办公小白选 WorkBuddy,编程新手选 Trae,喜欢折腾的选 Hermes 或 OpenClaw,高手进阶选 Claude Code 或 Codex。
在选择AI agent时候,先想想自己的使用场景,然后自己真实地去体验一下,这样才能选择到最适合自己的AI助手。关于每个AI agent详细介绍以及安装方法,我将在后边的文章介绍。
温馨提醒:以上这么多款agent,我只用过Claude cdoe和Hermes,其他agent的信息来源均来自其他网友反馈,评价可能具有一定主观性和信息的滞后性。



