AIREITER

ZCode vs Claude Code:2026 年谁更胜一筹?

最后更新: 2026-08-11 07:48:41

ZCode 桌面编码代理界面

2026 年 7 月 1 日,Z.ai 推出了面向 GLM-5.2 的桌面编码代理 ZCode。短短五周内连续发布十五个版本后,它已经补齐了定时任务、自定义模型子代理和项目级记忆等能力,与 Claude Code 的差距显著缩小。不过,在可组合 hooks、五层子代理嵌套以及终端优先的 CI 集成方面,ZCode 仍难以追上 Claude Code。

定位不同:桌面工作台与终端代理

这不是两个外壳相近的产品。ZCode 和 Claude Code 的架构取向不同,服务的开发习惯也不同。

维度ZCodeClaude Code
核心界面Electron 桌面应用(GUI)终端 CLI,并提供 VS Code、JetBrains、桌面端、网页端和 iOS 支持
默认模型GLM-5.2(744B MoE,MIT 权重许可)Claude Opus 4.8 / Sonnet 5(闭源权重)
BYOK 提供商Z.ai、Anthropic、OpenAI、OpenRouter、Moonshot、MiniMax、DeepSeek、Xiaomi MiMo仅 Anthropic 模型(会话提供商)
权限模式5 种(Default、Confirm、Auto Edit、Plan、Full Access)6 种(default、acceptEdits、plan、auto、dontAsk、bypassPermissions)
自主执行内置验证机制的 /goal覆盖 25 个生命周期节点的 Hooks + 基于分类器的 auto 模式
远程控制二维码配对(一部手机)、WeChat/Feishu 机器人二维码配对(32 个服务器会话)、Telegram/Discord/iMessage
平台macOS、Windows、Linux(beta)macOS、Windows、Linux、iOS、网页端
开放性闭源运行框架,模型权重采用 MIT 许可闭源运行框架、闭源权重

ZCode 把文件管理、终端、Git 和浏览器预览整合进一个桌面窗口。Claude Code 则默认从终端开始,并通过 CLAUDE.md 在 IDE 与网页端之间共享配置。

模型实力:GLM-5.2 对比 Claude Opus 4.8

默认模型的差异至关重要。两套工具都不强制绑定模型,但它们各自默认使用的模型,直接决定了日常体验。

基准测试GLM-5.2Opus 4.8来源
SWE-bench Pro62.1%69.2%Z.ai / 聚合平台
Terminal-Bench 2.181.085.0厂商公布数据
NL2Repo(长程任务)48.969.7通过聚合平台获得的独立评测
SWE-Marathon13.026.0通过聚合平台获得的独立评测

在短周期、单次完成的编码任务中,GLM-5.2 的表现可达到 Opus 4.8 的 95–99%。但任务一旦变成持续多步骤的代理工作,差距会明显拉大。以衡量长时间任务完成能力的 SWE-Marathon 为例,GLM-5.2 的得分只有 Opus 4.8 的一半。

速度则明显偏向 GLM-5.2。根据 Artificial Analysis 的数据,GLM-5.2 在最高速度下的中位数约为每秒 206 个 token,部分基础设施上可达到 457 tok/s。Anthropic API 上的 Opus 4.8 最高约为 63.5 tok/s。

代价是 token 输出更冗长。每项 Artificial Analysis Intelligence Index 任务中,GLM-5.2 约会消耗 43,000 个输出 token,其中约 37,000 个为推理 token;相比之下,GLM 5.1 为 26,000 个。Opus 4.8 单项任务的输出更克制,这也在一定程度上抵消了它更高的单 token 价格。

从 API 定价看,成本差异很直接:在 Z.ai API 上,GLM-5.2 的输入和输出价格分别为每百万 token $1.40 和 $4.40;在 Anthropic API 上,Opus 4.8 则是每百万 token $5/$25。在 Braintrust 的精确检索基准测试中,25K 上下文下,GLM-5.2 的准确率仅比 Opus 低 3.5 个点,但每条 trace 的成本约为后者四分之一;在 50K 上下文时,这一比例依然成立。

上线后,ZCode 补上了哪些能力

根据官方更新日志,ZCode 自发布以来已推出十五个版本,并在 2026 年 8 月 10 日达到 v3.7.5。这段时间新增的功能,弥补了最初 v3.2.x 版本的多项短板。

定时任务与空闲任务(v3.4.2,7 月 22 日)。任务现在可以按自定义计划执行,支持重复规则、截止日期,以及按任务设置模型和推理强度。任务卡片会直接显示在聊天中,定时任务历史也可以查看。

支持自定义模型子代理的空闲任务(v3.7.5,8 月 10 日)。最新版本允许空闲任务创建使用自定义模型的子代理。自动化任务也支持以分钟为单位设置自定义间隔,而不再局限于固定时间窗口。子代理还新增了可配置的推理强度;Claude Code 可以在会话级别设置这一项,但尚未支持按子代理设置。

项目级记忆(v3.6.5,8 月 3 日)。记忆现在按项目组织,并可在设置中浏览。通过 @ 提及系统,用户可以引用插件、文件和对话,工作区内的交叉引用更高效。

Kimi K3 支持(v3.4.2 + v3.6.5)。ZCode 在 7 月加入 Kimi K3,8 月加入 Kimi K3 256K,使其多模型阵容不再局限于 GLM 系列。其他提供商的官方支持模型如今也可以直接添加。

全局防休眠开关(v3.6.5)。在长时间运行 Goal Mode 迭代时,防止桌面应用进入挂起状态。

订阅价格低,不代表额度更耐用

从月订阅价格看,ZCode 每个档位都更便宜;但 GLM-5.2 消耗额度的速度,往往会掩盖这一表面优势。

档位ZCode / GLM Coding PlanClaude Code
入门Lite:$18/月(年付 $12.60)Pro:$20/月
中档Pro:$72/月(年付 $50.40)Max 5x:$100/月
高档Max:$160/月(年付 $112)Max 20x:$200/月

GLM Coding Plan 页面目前展示的是折后价格:Lite 每月 $12.60、Pro 每月 $56、Max 每月 $117.60。年付折扣加上新账户首个订阅 10% 优惠,还能进一步降低 ZCode 的实际成本。相比通过原始 API 或第三方运行框架使用同一套餐,ZCode 订阅用户的可用额度约为 1.5 倍。

问题在于,GLM-5.2 在代理循环中很容易大量消耗 token。GLM Coding Plan 在高峰期按 3 倍扣减额度,非高峰期则按 2 倍扣减。r/ZaiGLM 上有用户反馈,MCP 和网页搜索额度相较 Claude Code 消耗异常快;另一则讨论记录了一项 Goal Mode 任务消耗每周额度 27% 的情况,约为 5,500 万个 token。这些都只是单个用户的经验,但与 GLM-5.2 单任务 token 消耗更高的特征相符。

Z.ai 正在开展持续至 2026 年 9 月的非高峰期 1 倍扣减活动,等于取消了非高峰时段的额度倍率。对于能把重度自主运行安排到非高峰期的开发者来说,实际 token 成本大约可以减半。

Anthropic 的套餐更容易预测:Claude Pro 包含标准 Claude Code 用量,Max 5x 和 Max 20x 按倍率提高额度;Dynamic Workflows(长时间自主任务)则需要 Max、Team 或 Enterprise 套餐。

自主执行:Goal Mode 与 Hooks 的两条路线

两者都在解决“让代理持续工作直到完成”的问题,但实现思路几乎相反。

ZCode 的 Goal Mode 是开箱即用的方案。输入 /goal fix all TypeScript compiler errors 后,代理会持续迭代:尝试修复、执行独立验证,然后将目标标记为完成,或开启下一轮。它提供 /goal pause、/goal resume、/goal replace 和 /goal clear 等子命令。其验证机制尚未公开说明,因此更适合将其视为自动检查,而不是已被证明等同于测试套件门禁的机制。

Claude Code 的 hook 系统则是一套可组合的基础设施。根据 Hooks 文档,它们可以是 shell 命令、HTTP 调用、MCP 工具、提示词或代理,并能绑定到 25 个生命周期节点,包括 PreToolUse、PostToolUse、Stop 和 SubagentStop。例如,Stop hook 可以运行你的测试套件,在测试通过前阻止代理停止。相比信任模型的自我判断,这种方式提供了确定性的验证。

Claude Code 的 auto 模式又增加了一层保障:服务端分类器会在工具调用执行前进行评估,拦截破坏性操作、数据外泄尝试和疑似由提示注入驱动的命令。该功能需要用户主动开启,并要求使用较新的 Anthropic API 模型。ZCode 没有对应的基于分类器的安全层。

子代理:多供应商混用,还是更深层的委派

两者都有子代理,但各自的长处并不相同。

ZCode 子代理(根据文档,自 v3.2.0、6 月 29 日起处于 beta)属于用户级功能,只能在前台运行。它最大的亮点是按子代理混用不同供应商:一个子代理可使用 GLM-5.2,另一个调用 Anthropic 模型,第三个使用 DeepSeek,而且都能在同一会话中协作。自 v3.7.5 起,空闲任务可创建使用自定义模型的子代理,每个子代理也可单独设置推理强度。内置角色包括 general-purpose 和只读的 Explore。

Claude Code 子代理在结构化能力上更成熟。它支持项目级定义(.claude/agents/)和用户级定义(~/.claude/agents/),使用带 YAML frontmatter 的 Markdown 文件定义;根据 Claude Code 文档,可嵌套五层。自 v2.1.198 起,默认支持后台执行。单代理模型选择仅限 Claude 家族,包括 sonnet、opus、haiku、fable 或完整模型 ID。

如果你的工作流需要不同厂商的模型分别处理不同子任务,ZCode 的 BYOK 方式优势明显。如果你需要深层委派链,并希望整个团队能够通过版本控制维护项目级代理定义,Claude Code 更强。

数据治理与稳定性

Z.ai 的运营主体是注册于新加坡的 JINGSHENG HENGXING TECHNOLOGY PTE. LTD.。根据 Z.ai 文档,其 API 数据处理地点为新加坡;底层模型实验室则是智谱 AI。面向消费者的 ZCode 隐私条款允许收集对话、文件、代码、shell 命令和生成输出;API 条款则称,输入会实时处理且不存储。

Anthropic 依照美国法律处理数据。商业 API 使用及适用商业条款的 Claude Code,默认不会用于训练。符合条件的组织可以使用零数据保留服务,但安全分类器结果无论如何都会被保留。

GLM-5.2 采用 MIT 许可的权重,因此具备 Anthropic 闭源权重不具备的自托管路径。不过,根据 Z.ai 模型卡,完整精度的 GLM-5.2 约需要 1.57 TB VRAM,实用层面的自托管仍基本只适合企业。

稳定性方面,ZCode 的高频更新意味着新功能来得快,问题也会随之出现。仅 v3.7.5 的更新日志,就修复了记忆导航、预览渲染、消息排序、远程工作区重连和运行时切换后的模型状态持久化等问题。一名从 Claude Code 转来的用户在 r/ZaiGLM 上反馈,登录 ZCode 时持续遇到 OAuth 和 CAPTCHA 失败;社区回复建议改用 API token,或通过 OpenCode 接入 Z.ai 端点,以获得更可靠的替代方案。

该选哪一个?

如果你……推荐选择
偏好在一个窗口中完成文件管理、终端、Git 与预览的可视化桌面工作流ZCode
主要在终端或 CI 流水线中工作Claude Code
需要在同一会话中使用多家供应商的子代理ZCode
需要深层子代理嵌套及项目级代理定义Claude Code
希望以最少配置实现自主迭代ZCode(Goal Mode)
需要通过 hooks 构建可组合验证与确定性门禁Claude Code
对按 token 计费的成本敏感ZCode / GLM-5.2
受限于禁止使用中国关联供应商的政策Claude Code
想要 GLM-5.2 的成本结构,同时使用 Claude Code 的运行框架混合方案:Claude Code + 通过 API 接入 GLM-5.2

混合方案的做法是:通过设置 ANTHROPIC_BASE_URL 和 ANTHROPIC_AUTH_TOKEN,让 Claude Code 调用 Z.ai 的 Anthropic 兼容端点上的 GLM-5.2。这样可以按 GLM-5.2 的 token 价格,获得 Claude Code 的 hooks、子代理和 CI 集成。详细步骤可参考我们的 在 Claude Code 中使用 GLM-5.2 指南。代价是失去 ZCode 的 Goal Mode、桌面 UI 和多供应商子代理能力;此外,当 Z.ai API 负载较高时,也可能偶尔遇到连接问题。

ZCode 能取代 Claude Code 吗?

对于以 GUI 为主、独立开发、任务范围明确且周期较短的工作,ZCode 足以作为日常主力工具。对于集成 CI、团队协作和长周期任务的工作流,Claude Code 依然更强,因为 Opus 4.8 在持续性基准测试中的表现高出 2 倍。

可以在 Claude Code 中使用 GLM-5.2 吗?

可以。将 ANTHROPIC_BASE_URL 设置为 Z.ai 的端点,并将 ANTHROPIC_AUTH_TOKEN 设置为你的 Z.ai API 密钥即可。GLM Coding Plan 支持 Claude Code 在内的 20 多种编码工具,因此你的订阅额度同样适用。

ZCode 的稳定性够日常使用吗?

ZCode 的 v3.7.5 修复了记忆导航、预览渲染和远程工作区重连等重要问题,但每次发布覆盖如此广泛的修复范围,也说明产品仍存在活跃的脆弱点。r/ZaiGLM 上报告的 OAuth 和 CAPTCHA 故障表明,认证可靠性仍值得关注。如果你的工作流不能接受停机,建议保留 Claude Code 或 OpenCode 作为备用方案。