引言
如果你是中国AI新手,选第一款AI Agent工具时可能会感到困惑。我们测试了六款主流Agent产品,按对国内新手的实用性排名,分析优缺点和实际使用限制,提供实操建议帮你做出明智选择。
中国新手总排名
最终评分参考,满分5.0:
- Codex(ChatGPT驱动):5.0/5
- WorkBuddy(腾讯官方Agent):4.0/5
- Z-Code和Trae:3.5/5(并列第三)
- Claude Code:2.5/5
- OpenClaw / Hermes:2.0/5
1. Codex(现已更名为ChatGPT-Agent,首选推荐)
核心优势
Codex运行在OpenAI GPT-5.6系列的Sol、Terra和Luna模型上。性能与Claude系列不相上下,但价格更低、token配额更高。与仅面向开发者的Claude Code不同,Codex充分考虑职场人士日常需求,拥有电子表格、PPT、Figma设计和浏览器自动化的庞大插件生态。其Agent harness能力——控制大模型的能力——全行业顶级。
安装步骤
- 准备海外网络访问和有效海外支付方式。
- 终端运行安装命令:
pip install openai-codex-desktop - 用ChatGPT账号登录,从插件市场启用Computer-Use等插件。
不足
对中国用户有两个明显障碍:需要稳定国际网络访问,仅接受海外支付方式。能解决这两个问题,Codex是首选。不能的话跳过选WorkBuddy。
重要提示:将第三方国产模型接入Codex替代官方GPT模型时,多Agent协作和Computer-Use等高级功能将失效,Codex失去核心优势。
2. WorkBuddy(腾讯出品,国产最佳新手选择,4.0/5)
核心亮点
WorkBuddy是腾讯面向中国用户设计的官方Agent应用。支持主流开源国产大模型和自定义第三方模型集成。连接几乎所有腾讯系软件,包括微信、飞书和QQ。提供文档处理、Excel分析、法律咨询和内容创作的预置技能。多人项目协作功能可拆分任务并追踪AI辅助的项目进度。
现存问题
最大问题来自产品设计理念:仍遵循传统To-C设计而非To-Agent设计。例如项目指引文件保存为PDF格式,AI无法直接解析。如需AI自动读取指令,须用Markdown格式。可用Python代码将PDF转为AI友好的markdown(代码见正文)。Codex和Claude Code中约80%功能在后台运行由AI自动调用,但WorkBuddy中用户需手动选择每项技能,AI无法自主选择合适技能,也不允许自定义专家Agent。虽有这些缺陷,若Codex不可用,WorkBuddy仍是中国新手的最佳国产选择。
3. 中游工具:Trae和Z-Code(3.5/5)
Trae(火山引擎开发)
支持大多数流行国产开源模型和第三方模型添加。但技能库远小于WorkBuddy,多数技能由火山引擎或开源社区开发,缺乏第三方开发者资源。基础文档分析和PPT生成还行,复杂Agent驱动任务能力不足。
Z-Code(智谱AI出品)
仅默认搭载GLM-5.2和GLM-5模型。高级版本需订阅付费Coding-Plan,但经常缺货。免费用户每日仅50万token。运行zcode quota-check查看剩余配额。唯一亮点是原生集成飞书和微信。除此无其他竞争优势。只有智谱模型的铁粉才适合选Z-Code。
4. Claude Code(中国用户仅2.5/5)
Claude Code是现代Agent系统的先驱,搭载Fable 5和Opus 4.8模型,大多数基准超越GPT系列。Agent-harness能力设定了行业标准。
中国用户的关键障碍
- 需要稳定的海外网络访问。
- 仅接受国际支付。
- 最严格的限制来自Anthropic:系统持续检测用户地区信息,一旦确认来自中国,即使已付费也会永久封禁账号。
桌面UI为专业开发者打造,全英文界面。多数功能隐藏在图形界面之外,对新手极端困惑。不推荐普通用户尝试。
5. OpenClaw / Hermes(2.0/5,仅限进阶用户)
OpenClaw和Hermes近期流行但学习曲线陡峭。虽有桌面版但需安装独立App。可连接微信和即时通讯工具,一句话提示词分配任务。但多数用户找不到充分发挥其功能的日常场景。建议先用Codex或WorkBuddy,掌握基础Agent用法后再考虑OpenClaw进阶探索。
最终选型指南
- 能搞定海外网络和支付:毫不犹豫选Codex;
- 海外访问不可能:WorkBuddy是首选;
- 仅需轻量AI辅助:选Trae或Z-Code;
- 学习早期避免Claude Code和OpenClaw:防止账号损失和时间浪费。
常见问题
Codex有访问障碍为什么还排第一?
因为如果你能克服网络和支付障碍,Codex在客观上以较大优势提供最佳体验。GPT-5.6模型家族(Sol、Terra、Luna)在大多数基准上匹敌或超越Claude,插件生态几乎覆盖所有办公任务,"approve for me"模式让Agent自动化流畅安全。排名反映产品质量而非可访问性。指南明确说明:搞不定访问问题就跳到第2名WorkBuddy。这不是"最容易访问"的排名——而是"如果能用,哪个工具最好"的排名。
Trae和Z-Code同样3.5分,实际区别是什么?
并列因各有互补的优势和短板。Trae支持第三方模型(不锁定一家供应商)但技能库极小。Z-Code有原生飞书/微信集成(对中国职场人士真正有用)但锁定GLM模型且付费计划经常不可用。模型灵活性重要选Trae。日常已用飞书/微信且在智谱生态中选Z-Code。两个因素都不重要的话,同等可访问性的WorkBuddy 4.0/5更好。
Claude Code对中国用户真的那么差吗?
2.5/5的评分不是针对Claude Code的质量——它可能是市面上最复杂的Agent系统。评分反映的是中国用户的灾难性风险:Anthropic主动检测并封禁来自不支持地区(包括中国)的用户。你可能付了费、用了好几周、建了工作流——然后一夜之间全部失去,账号永久封禁。对了解风险并采取适当预防措施的开发者(通过第三方服务仅用API),Claude Code很优秀。对可能花时间构建项目和Workflow的新手,突然账号丢失的风险使其不适合。指南建议学习早期避免,是风险管理建议而非质量判断。
以后能在这些工具间切换吗,还是会被锁定?
不会被锁定——这些是独立应用,不是有供应商锁定的平台。很多专业人士使用多个工具:Codex做重型开发、WorkBuddy做中文办公任务、Claude Code做专业编码工作。你学到的技能(提示词工程、工作流设计、Agent编排)在工具间可迁移。指南建议从一款匹配你访问水平的工具开始,掌握后按需添加其他。唯一不能迁移的是项目特定配置(agent.md文件、技能配置、自动化设置)——这些是工具专属的,切换时需重建。