ZCode 正式发布:Z.ai 官方编程 Agent 引入独立 Endpoint 架构,路由团队需要重新梳理配置
Z.ai 于 7 月 2 日正式发布 ZCode,这是基于 GLM-5.2 的免费 Agentic 开发环境。对路由团队而言,本次发布引入了独立的 coding endpoint、Anthropic/OpenAI 双协议通道、第三方 BYOK 渠道,以及 7 月 31 日截止的 1.5x 配额促销。
归档条目:由 AI 根据所引信源辅助生成,发布时未经逐篇审阅。责任编辑:Joe Werner。

Z.ai 于 2026 年 7 月 2 日正式发布 ZCode,新闻周期的焦点集中在竞品对比——Cursor、Claude Code、GitHub Copilot,再加上这个新面孔。然而这种框架忽视了真正值得关注的运营细节:ZCode 是 GLM 系列中第一个在产品层面暴露**独立 coding endpoint(与 BigModel 通用 API 分离)**的编程 Agent,同时支持 Anthropic 和 OpenAI 双协议,提供面向第三方模型的 BYOK 渠道,以及 25 天后即将结束的限时配额折扣。
如果你的团队负责路由编程 Agent 流量,以上每一个细节都会影响 provider 的配置方式。
发生了什么
Z.ai(前身为智谱 AI)于 7 月 2 日推出 ZCode,这是一款支持 macOS、Windows 和 Linux 的免费桌面应用。该 Agent 以 GLM-5.2 为核心——智谱 6 月发布的旗舰 1M 上下文编程模型,已以 MIT 协议开源。ZCode 以长程"Goal"为核心组织开发任务:Agent 负责规划、编辑、运行检查并迭代,而非执行单次 prompt。
产品还包括通过微信、飞书和 Telegram 进行远程控制——这一差异化功能面向中国开发团队——以及订阅制计划(Lite $16.20/月 → Max $144/月),其定价明显低于 Claude Code 和 Cursor 的同等套餐。
为什么 AI 工程团队需要关注
ZCode 的三个架构决策对路由层产生直接影响:
1. coding endpoint 与通用 endpoint 是分开的。 对于使用 API Key 而非 OAuth 的团队,ZCode 文档中为 Coding Plan 订阅用户提供了专属路径:
OpenAI Base URL: https://open.bigmodel.cn/api/coding/paas/v4
这与 BigModel 通用 endpoint(https://open.bigmodel.cn/api/paas/v4)是不同的地址。如果将 GLM-5.2 编程流量路由到错误的 base URL,要么会错误消耗通用配额,要么直接失败。这是一个容易犯、难以察觉的配置错误——通常只有配额耗尽时才会发现。
2. GLM-5.2 通过 BigModel 同时支持 Anthropic 和 OpenAI 协议。 ZCode 配置文档暴露了两个协议通道:
- Anthropic 协议:
https://open.bigmodel.cn/api/anthropic - OpenAI 协议:
https://open.bigmodel.cn/api/paas/v4
这对通过 gateway 路由 Claude Code 或其他 Anthropic SDK 客户端的团队至关重要。如果 gateway 通过 Anthropic 协议将流量路由到 BigModel 的 GLM-5.2,两种协议之间的行为差异——包括 thinking mode 激活方式和消息格式——可能会在不同 provider 之间产生不一致的输出。
3. 通过第三方 provider 渠道实现 BYOK。 ZCode 明确支持通过 Anthropic 或 OpenAI 协议将流量路由到第三方模型。这意味着团队可以将自己的 gateway 配置为 ZCode 的"第三方 provider",从而将所有 Agent 流量(包括非 GLM 调用)通过统一的策略层管理。这是一个开放的 BYOK 架构,而非封闭系统。
Router/Operator 视角
以下是为路由 ZCode 支持的 GLM-5.2 流量的团队提供的决策矩阵:
| 场景 | 推荐配置 |
|---|---|
| 直接处理编程密集型工作负载,Coding Plan 订阅用户 | 使用专属 coding endpoint /api/coding/paas/v4;不要与通用 endpoint 混用 |
| 通过 OpenAI 兼容 gateway 路由 GLM-5.2 | 将 gateway 指向 /api/paas/v4;按 OpenAI 兼容上游处理 |
| 通过 Anthropic 兼容 gateway 路由 GLM-5.2 | 将 gateway 指向 /api/anthropic;验证 thinking mode 在你的工作负载下的行为 |
| 多 provider Agent 路由(GLM + Claude + Codex) | 使用 ZCode 的 BYOK"第三方 provider"渠道;通过统一策略层路由所有流量 |
7 月 31 日配额因素。 整个 7 月,ZCode 对 Coding Plan 订阅用户应用 0.67x 的 token 消耗系数——相当于将计划配额延长约 50%。为下一个计费周期建模 token 成本的路由团队需要注意:这一促销价格将在 8 月 1 日消失。请使用标准费率而非促销费率构建成本预估。
供应链来源注意事项。 Z.ai 已确认 GLM-5.2 完全在中国国产加速器上训练。对于在 AI 供应链中包含芯片来源或司法管辖区标准的企业路由策略而言,GLM-5.2 具有可验证的国产芯片来源,这与在美国或欧盟硬件上训练的模型不同。这与合规感知路由策略相关,而非性能或质量声明。
TheRouter 用户应关注或尝试的内容
已通过 OpenAI 兼容 gateway 进行路由的团队,可以将 BigModel 的 OpenAI endpoint 添加为 provider,并使用标准的模型名称路由规则将 GLM-5.2 编程流量路由到该 endpoint。关键配置细节:通用访问使用 https://open.bigmodel.cn/api/paas/v4 作为 base URL;如果你是 Coding Plan 订阅用户并希望使用专属编程配额,则使用 https://open.bigmodel.cn/api/coding/paas/v4。
在 7 月 31 日促销截止前的三个运营检查点:
- 审查你的 GLM-5.2 流量命中了哪个 endpoint。 通用 endpoint 与 coding endpoint 的配额池是分开的。
- 验证协议一致性。 如果你通过 Anthropic 协议和 OpenAI 协议分别路由部分流量,确认 thinking mode 和消息格式在你的工作负载类型下表现一致。
- 为 8 月重置成本模型。 0.67x 系数带来的 1.5x 有效配额将于 7 月 31 日结束。8 月及以后的所有成本预测应使用标准费率。
ZCode 可免费试用。BYOK 架构使集中路由层成为自然的适配选项——operator 可以将 ZCode 指向自己现有的 gateway 作为"第三方 provider",从而在单一位置获得对所有编程 Agent 模型调用的可见性和策略执行能力。
本文涉及的模型
相关阅读
AI 路由新闻与供应商动态 →
GLM-5.2 OpenRouter 接入指南:TPS 基准、定价对比与 Coding Agent Routing 配置
GLM-5.2 已在 OpenRouter(z-ai/glm-5.2)及其他 12 家服务商上线。Artificial Analysis 实测最快输出速度达 266 t/s(Baseten),最低价格 $0.72/1M tokens(GMI FP8)。凭借经验证的 Solid 1M token 无损上下文与 128K 最大输出,GLM-5.2 在 FrontierSWE 上与 Claude Opus 4.8 差距仅 1%,是长程 coding agent routing 的顶级开放权重选项。

Zhipu 一次模型级 429 让 GLM flash 系列断流。TheRouter 现在按模型冷却,并为它们加了第二条路由。
2026-10-02,Zhipu 的 API 对 glm-4.6v-flash 返回了只针对该模型的限流响应,TheRouter 却把整个账号停了下来。现在冷却按模型生效,六个 GLM flash 系列模型也通过 Zhipu 的国际服务获得了第二条路由。

Qwen3.8-Max 成为 DashScope 顶级模型:旗舰升级对你的路由策略意味着什么
阿里巴巴的 qwen3.8-max 登陆 DashScope,拥有 2.4T 参数、1M 上下文和思考模式——同时 qwen3.7-max 降入旧版。以下是路由 Qwen 旗舰层级的团队需要了解的变化。