这六款工具经常被放在一起比较,但它们并不完全竞争——代表的是 AI Agent 工具的三个不同方向。把它们强行放在同一张对比表里,会掩盖掉最关键的选型信息。本文先理清分类,再逐一讲每款工具的核心差异,最后给出按用户类型的选型建议。

 

三个方向,六款工具

工具

厂商

定位

主要用户

是否开源

Claude Code

Anthropic

终端编程 Agent

开发者

Codex

OpenAI

终端 + 云端编程 Agent

开发者

OpenCode

社区

开源模型无关编程 Agent

开发者

是(188K+ stars)

ZCode

智谱 AI

国产终端编程 Agent

开发者(中文生态)

Hermes

Nous Research

通用自主 Agent

开发者 + 进阶用户

是(218K+ stars)

WorkBuddy

腾讯云

消息优先办公 Agent

PM / 运营 / 办公用户

 

终端编程类:Claude Code、Codex、OpenCode、ZCode

Claude Code(Anthropic)

核心模型 Opus 4.8,SWE-bench Verified 87.6%,上下文窗口 100 万 token。终端原生,支持 VS Code、JetBrains 插件、桌面应用和 Web。CLAUDE.md 实现项目上下文持久化,Hooks 支持工作流自定义,Sub-agents + Dynamic Workflows 支持大型任务并行。

定价:Pro 约 145 元/月;Max 5x 约 730 元/月;Max 20x 约 1460 元/月。

最突出的能力:调试和复杂业务逻辑任务(多项第三方测评一致);1M token 上下文处理大型代码库时优势明显;SWE-bench 代码修复类任务目前业界前两名之一。

Codex(OpenAI)

GPT-5.5 驱动,SWE-bench Verified 88.7%,目前公开排行榜第一。提供三种形态:Codex Cloud(并行云端任务)、Codex CLI(本地终端)、IDE 扩展。可通过 GitHub、Linear、Slack 发起任务,支持无人值守跑 24 小时以上。

定价:Go 约 60 元/月;Plus 约 145 元/月;Pro 5x 约 730 元/月;Pro 20x 约 1460 元/月。有免费 Go 档,Claude Code 没有。

最突出的能力:SWE-bench 第一名;多文件批量重构;云端异步任务委派;适合把定义好的任务交出去等结果的工作方式。

OpenCode

开源(github.com/anomalyco/opencode),188,000+ stars,900+ 贡献者,月活 750 万开发者。支持 75+ LLM 提供商,包括本地模型,不绑定单一厂商。自带 LSP 支持,多会话并行,会话分享链接。可用 GitHub Copilot 或 ChatGPT Plus 订阅登录,部分免费模型开箱即用。

定价:使用自己的 API Key 则近乎免费;如果复用已有 Claude/GPT/Gemini 订阅,零额外成本。

最突出的能力:模型完全自由切换(含本地模型);不存储代码数据,隐私友好;成本可控到极致;开源可审计。如果你已经有某个模型的 API Key,OpenCode 是最低成本进入 AI 编程 Agent 的方式。

ZCode(智谱 AI)

基于 GLM-5.2,3.0 版本引入自研 ZCode Agent 内核,覆盖规划、编码、评审、上线全流程。桌面端支持 macOS、Windows 和 Linux(Beta)。最特别的是 Bot 控制功能:可在微信、飞书或 Telegram 里发指令,ZCode 在后台执行编程任务,把结果推回消息界面。

定价(GLM Coding Plan):Lite 约 118 元/月;Pro 约 473 元/月;Max 约 1051 元/月。

最突出的能力:国产 GLM-5.2 深度适配,国内访问稳定;Bot 控制让不开发机也能远程触发编程任务;官方适配的中文开发者工具链。

 

通用自主 Agent 类:Hermes

Hermes(Nous Research)

Hermes 与上面四款工具的定位根本不同:它不是"帮你写代码的编程助手",而是"越用越强的自主 Agent"。218,000+ stars,MIT 开源,由 Nous Research(Hermes、Nomos、Psyche 模型背后的团队)开发,2026 年 2 月发布。

核心差异:自我改进学习循环。 Hermes 会从每次交互中创建 Skills,在使用中自我改进,跨会话积累对用户的理解(通过 Honcho 用户建模 + FTS5 全文检索)。用得越多,它对你的工作方式、偏好和项目上下文的理解越深。

功能范围比编程工具宽得多:

 60+ 内置工具,覆盖文件、代码、网页、图像生成、TTS

 20+ 消息平台:Telegram、Discord、Slack、WhatsApp、Signal、Matrix、微信、QQ Bot、钉钉、飞书等

 定时自动化:内置 cron,可定时触发任务并推送到任意平台

 子代理并行:支持隔离的 subagent 并行执行

 多种运行后端:本地、Docker、SSH、Modal(无服务器,闲置成本极低)

定价:MIT 开源免费;Nous Portal 订阅打包了 web 搜索、图像生成、TTS 等工具网关的访问权限(不用自己配各种 API)。

最突出的能力:学习循环——这是 Hermes 与其他所有工具最核心的区别;运行基础设施极灵活(5 美元 VPS 也能跑);消息平台覆盖最广。如果你想要一个长期陪伴、越来越了解你工作习惯的 Agent,Hermes 是目前最接近的选项。

 

消息优先办公类:WorkBuddy

WorkBuddy(腾讯云)

WorkBuddy 不是编程工具——它是面向 PM、运营、销售、市场、行政的 AI 办公 Agent。2026 年 3 月 9 日由腾讯云推出,2026 年 5 月推出全球版(接入 Slack、Discord、Telegram)。

产品哲学与上面五款完全不同:用户在微信/企业微信/Slack 里发一句话,WorkBuddy 在后台执行(分钟到小时级反馈节奏),把 PPT、表格、调研报告通过同一聊天窗口发回来。100+ 内置 Expert Skills 覆盖发票处理、竞品调研、舆情分析、数据处理等高频办公场景。

上线后 90 天:月访问量 885 万,是国内第二名生产力 Agent 的 2 倍以上(2026 年 3 月数据)。核心优势是微信/企业微信/QQ 的 IM 基础设施入口——这是 Anthropic 和 OpenAI 在国内复制不了的。

代价:透明度低(出错只能重发,难以调试);不适合超出场景列表的长尾任务;敏感数据经由 IM 传输有隐私边界问题。

 

选型建议

我主要写代码,想要最高代码质量 → Codex(SWE-bench 第一)或 Claude Code(调试最强、长上下文最好)

我想要灵活切换模型 / 成本最低 / 用本地模型 → OpenCode(免费开源,75+ 提供商)。需要在 OpenCode 里接入国内可直接访问的模型时,七牛云 AI 提供多款主流大模型的统一接口配置,可参考:developer.qiniu.com/aitokenapi/13195/AI-Coding

我在国内,GLM 生态 / 不想处理翻墙问题 → ZCode(GLM-5.2 官方适配,国内访问稳定)

我想要一个长期进化、越用越聪明的 Agent,不只是编程 → Hermes(学习循环、20+ 平台、MIT 开源)

我不是开发者,想在微信 / 飞书里直接完成办公任务 → WorkBuddy(消息优先,100+ 内置场景)

 

结语

这六款工具的核心分歧不在"谁的模型更好",而在"谁的产品哲学更匹配你的工作方式"。Claude Code 和 Codex 在拼基准分和代码质量;OpenCode 和 Hermes 在拼开放性和灵活性;ZCode 在拼国内适配;WorkBuddy 在拼非技术用户的使用门槛。选错了方向,功能再强也没用。

本文数据来自各产品官网(2026 年 7 月)、GitHub 仓库统计、Medium《Claude Code vs Codex vs OpenCode》(2026 年)及 chenguangliang.com 的 WorkBuddy 深度分析。

 

参考资料

 OpenCode 官网:opencode.ai

 OpenCode GitHub:github.com/anomalyco/opencode(188K stars)

 ZCode 官网:zcode.z.ai/cn

 Hermes Agent 文档:hermes-agent.nousresearch.com/docs

 GitHub:github.com/nousresearch/hermes-agent(218K stars)

 Claude Code 官方文档:code.claude.com/docs

 Codex 官方文档:learn.chatgpt.com/docs

 WorkBuddy 分析:chenguangliang.com

 七牛云 AI 编程工具配置大全(OpenCode/Hermes 接入多款主流大模型参考):https://developer.qiniu.com/aitokenapi/13498/Hermes-Agent