Запуск ZCode: официальный coding agent от Z.ai вводит новую архитектуру endpoint, которую команды маршрутизации обязаны переосмыслить
Z.ai официально запустила ZCode 2 июля — бесплатную среду agentic-разработки на базе GLM-5.2. Для команд маршрутизации запуск вводит отдельный coding endpoint, двойные каналы Anthropic/OpenAI, BYOK через сторонние каналы и промо 1.5x квоты, действующее до 31 июля.
Архивный материал, подготовленный с помощью ИИ по указанному источнику и опубликованный без индивидуальной проверки. Ответственный редактор: Joe Werner.

Когда Z.ai официально запустила ZCode 2 июля 2026 года, новостной цикл сосредоточился на конкурентном позиционировании — Cursor, Claude Code, GitHub Copilot, теперь ещё один. Этот угол зрения упускает главное с операционной точки зрения: ZCode — первый production coding agent семейства GLM, который открывает отдельный coding endpoint, независимый от общего API BigModel, двойную поддержку протоколов (Anthropic и OpenAI), BYOK-канал для сторонних моделей и ограниченную по времени ценовую акцию на квоту, истекающую через 25 дней.
Если ваша команда маршрутизирует трафик coding agent, каждая из этих деталей меняет то, как вы настраиваете провайдеров.
Что произошло
Z.ai (бывшая Zhipu AI) выпустила ZCode — бесплатное десктопное приложение для macOS, Windows и Linux — в среду, 2 июля. Agent построен вокруг GLM-5.2, флагманской модели Zhipu с контекстом 1M токенов и MIT-лицензированными открытыми весами, выпущенной в июне. ZCode организует разработку вокруг долгосрочных «Goals»: agent планирует, редактирует, запускает проверки и итерирует по всей задаче, а не выполняет одиночные промпты.
Продукт включает удалённое управление через WeChat, Feishu и Telegram — дифференциатор для китайских команд разработчиков — а также структуру подписок ($16.20/мес Lite → $144/мес Max), которая значительно ниже сопоставимых тарифов Claude Code и Cursor.
Почему это важно для команд AI-инженеров
Три архитектурных решения в ZCode создают прямые импликации для маршрутизации:
1. Coding endpoint отличается от общего endpoint. Для команд, использующих API-ключи вместо OAuth, ZCode документирует отдельный путь для подписчиков Coding Plan:
OpenAI Base URL: https://open.bigmodel.cn/api/coding/paas/v4
Это отдельный адрес от общего endpoint BigModel (https://open.bigmodel.cn/api/paas/v4). Маршрутизация coding-трафика GLM-5.2 через неправильный base URL либо некорректно израсходует общую квоту, либо приведёт к ошибке. Это ошибка конфигурации, которую легко допустить и трудно заметить — обычно обнаруживается только когда заканчивается квота на неправильном тире.
2. GLM-5.2 поддерживает оба протокола через BigModel — Anthropic и OpenAI. Конфигурация ZCode открывает два канала:
- Протокол Anthropic:
https://open.bigmodel.cn/api/anthropic - Протокол OpenAI:
https://open.bigmodel.cn/api/paas/v4
Это важно для команд, маршрутизирующих Claude Code или другие Anthropic SDK клиенты через gateway. Если gateway направляет трафик к BigModel для GLM-5.2 через протокол Anthropic, различия в поведении между двумя протоколами — включая активацию thinking mode и формат сообщений — могут привести к несогласованным результатам между провайдерами.
3. BYOK через каналы сторонних провайдеров. ZCode явно поддерживает маршрутизацию к сторонним моделям через протоколы Anthropic или OpenAI. Это означает, что команды могут настроить gateway как «сторонний провайдер» ZCode и направить весь трафик agent — включая вызовы не-GLM — через центральный слой политик. Это BYOK-модель, а не закрытая система.
Угол маршрутизации / операторский взгляд
Матрица принятия решений для команд, маршрутизирующих трафик GLM-5.2 через ZCode:
| Сценарий | Рекомендуемая конфигурация |
|---|---|
| Прямые coding-нагрузки, подписчик Coding Plan | Используйте dedicated coding endpoint /api/coding/paas/v4; не смешивайте с общим endpoint |
| Маршрутизация GLM-5.2 через OpenAI-совместимый gateway | Укажите gateway на /api/paas/v4; обращайтесь как с любым OpenAI-совместимым upstream |
| Маршрутизация GLM-5.2 через Anthropic-совместимый gateway | Укажите gateway на /api/anthropic; проверьте поведение thinking mode для вашей нагрузки |
| Маршрутизация agent с несколькими провайдерами (GLM + Claude + Codex) | Используйте BYOK-канал «сторонний провайдер» ZCode; маршрутизируйте весь трафик через единый слой политик |
Фактор квоты до 31 июля. До конца июля ZCode применяет коэффициент потребления токенов 0.67x для подписчиков Coding Plan — фактически увеличивая квоту плана примерно на 50%. Командам маршрутизации, моделирующим стоимость токенов для следующего расчётного периода, необходимо учитывать: это промо-тарифа исчезает 1 августа. Строите прогнозы затрат, используя стандартный тариф, а не промо.
Примечание о происхождении цепочки поставок. Z.ai подтвердила, что GLM-5.2 был обучен исключительно на китайских ускорителях отечественного производства. Для корпоративных политик маршрутизации, включающих критерии происхождения чипов или юрисдикции в цепочке поставок AI, GLM-5.2 имеет верифицируемое китайское происхождение чипов — в отличие от моделей, обученных на американском или европейском оборудовании. Это актуально для compliance-ориентированных политик маршрутизации, но не является заявлением о производительности или качестве.
Что пользователям TheRouter стоит проверить или попробовать
Команды, уже маршрутизирующие через OpenAI-совместимый gateway, могут добавить endpoint OpenAI от BigModel как провайдера и маршрутизировать coding-трафик GLM-5.2 к нему со стандартными правилами маршрутизации по имени модели. Ключевая деталь конфигурации: используйте https://open.bigmodel.cn/api/paas/v4 как base URL для общего доступа, или https://open.bigmodel.cn/api/coding/paas/v4 если вы подписчик Coding Plan и хотите использовать выделенную coding квоту.
Три операционных контрольных точки до дедлайна акции 31 июля:
- Проверьте, какой endpoint обрабатывает ваш трафик GLM-5.2. Общий endpoint и coding endpoint имеют раздельные пулы квот.
- Проверьте согласованность протоколов. Если вы маршрутизируете часть трафика через протокол Anthropic, а часть через OpenAI, убедитесь, что поведение thinking mode и формат сообщений согласованы для вашего типа нагрузки.
- Пересчитайте стоимостные модели для августа. Эффективная квота 1.5x от коэффициента 0.67x заканчивается 31 июля. Прогнозы на август и далее должны использовать стандартный тариф.
ZCode доступен бесплатно. Архитектура BYOK делает централизованный слой маршрутизации естественным решением — операторы могут направить ZCode на свой существующий gateway как «сторонний провайдер» и получить видимость и применение политик для всех вызовов модели coding agent в одном месте.
Модели, упомянутые в статье
Похожие материалы
Новости AI-роутинга и провайдеров →
GLM-5.2 на OpenRouter: бенчмарки TPS, цены провайдеров и routing для coding-агентов
GLM-5.2 combines a verified 1M-token context, 128K max output, and strong coding-agent benchmarks. Routing teams should evaluate latency, pricing, provider fit, and long-horizon workloads.

Qwen3.8-Max — теперь топовая модель DashScope: что смена флагмана меняет в вашей routing-политике
qwen3.8-max появился на DashScope: 2.4T параметров, 1M контекст и режим размышлений — а qwen3.7-max переведён в legacy. Что меняется для команд, маршрутизирующих трафик на флагманский уровень Qwen.

GLM-5.2 Fast Mode на DashScope подешевел на 20%: что изменилось в вашей модели routing-затрат
Alibaba Cloud Bailian снизила цену токенов для GLM-5.2 Fast mode на 20% с 15 июля. Для операторов, маршрутизирующих нагрузки через OpenAI-совместимый endpoint DashScope, формула стоимости изменилась.