DeepSeek 官方 Agent 集成指南:[1m] 上下文说明符与模型映射表——AI 网关必须掌握的路由配置
DeepSeek 发布了涵盖 Claude Code、GitHub Copilot 等 15 个工具的官方 Agent 集成文档。其中最关键的路由细节:括号上下文后缀语法与服务端模型映射表,直接决定了 AI 网关转发请求时实际落到哪个 DeepSeek 模型层。
归档条目:由 AI 根据所引信源辅助生成,发布时未经逐篇审阅。责任编辑:Joe Werner。
![DeepSeek V4 Pro [1m] 上下文说明符与 Claude Code 路由模型映射示意图](/news/deepseek-v4-pro-1m-model-specifier-claude-code-routing/cover.webp)
DeepSeek 悄然更新了官方 API 文档,新增了完整的 Agent 集成 章节,覆盖 15 款工具:Claude Code、GitHub Copilot、GitHub Copilot CLI、Kilo Code、WorkBuddy/CodeBuddy、OpenCode、Oh My Pi、OpenClaw、AstrBot、Deep Code、Hermes、nanobot、Crush、Pi、Reasonix 及 Langcli。对 AI 工程团队而言,表面上的故事是生态覆盖范围的扩展;更值得关注的则是一个新的模型说明符语法和一份官方模型映射表——这两项内容直接影响你的请求最终落在哪个 DeepSeek 计费层。
官方文档新增的两项关键路由规范
[1m] 上下文长度后缀。 官方推荐的 Claude Code 配置如下:
export ANTHROPIC_MODEL=deepseek-v4-pro[1m]
export ANTHROPIC_DEFAULT_OPUS_MODEL=deepseek-v4-pro[1m]
export ANTHROPIC_DEFAULT_SONNET_MODEL=deepseek-v4-pro[1m]
export ANTHROPIC_DEFAULT_HAIKU_MODEL=deepseek-v4-flash
export CLAUDE_CODE_SUBAGENT_MODEL=deepseek-v4-flash
export CLAUDE_CODE_EFFORT_LEVEL=max
[1m] 后缀是一个括号表示法,明确要求激活 V4 Pro 模型的 100 万 token 上下文窗口层。不加该后缀时,API 默认使用较短的上下文层。对于 agent 工作负载——大型代码库的完整上下文、跨文件重构、长推理链——默认层与 [1m] 层的差距,就是"中途上下文截断"与"任务完整完成"之间的差距。
服务端模型映射表。 当 Claude Code 或 Claude Desktop 通过 DeepSeek Anthropic API 端点(https://api.deepseek.com/anthropic)发送请求时,DeepSeek 会在服务端自动进行以下映射:
| Claude 模型名称前缀 | 实际路由至 |
|---|---|
claude-opus-* | deepseek-v4-pro |
claude-sonnet-* | deepseek-v4-flash |
claude-haiku-* | deepseek-v4-flash |
这意味着通过 AI 网关将 Claude Code 请求转发至 DeepSeek Anthropic 端点的团队,无法在网关层通过模型名称实现精细路由——服务端映射表会覆盖掉网关设置的 Claude 模型名。
对 AI 工程团队的实际影响
上下文成本成为路由维度。 [1m] 后缀不仅是便利性选项——它是一个主动触发高成本 100 万上下文层的开关。DeepSeek 的计费结构区分了不同上下文窗口规格;带 [1m] 后缀的请求按 100 万 token 上下文定价计费,即便实际会话很短也不例外。正确的路由策略是:仅对 Opus 层(编排器)请求附加 [1m],Haiku 等级的子 agent 调用改走 deepseek-v4-flash 且不带后缀——官方文档的配置示例正是这一模式。
Anthropic 端点模型映射表导致网关层模型锁定失效。 如果你的 AI 网关负责将 Claude 模型名翻译后转发至 https://api.deepseek.com/anthropic,你实际上失去了 DeepSeek 模型粒度的控制权——映射表仅基于请求 Claude 模型名的前缀(opus→pro,sonnet/haiku→flash)来决定路由。需要明确指定 deepseek-v4-pro 的团队,应改用 OpenAI 兼容端点(https://api.deepseek.com),并在 ANTHROPIC_MODEL 中直接写入 DeepSeek 模型 ID,而非经由 Anthropic 格式路由。这是两个行为不同的独立路由面。
Web 搜索会触发第二次计费。 DeepSeek API 原生支持 Claude Code 的 Web 搜索工具。当请求触发 Web 搜索时,API 会发起第二次 LLM 调用来汇总检索内容。这意味着启用 Web 搜索的 agent 会话,每次工具调用产生两次计费事件。构建成本仪表盘或按会话归因的团队需要将这个隐藏的第二次调用纳入用量核算。
生态系统已涵盖 15 个官方文档化集成工具。 DeepSeek 已从最初的 Claude Code + OpenCode 扩展至更广泛的 agent 工具目录。Kilo Code、Oh My Pi、AstrBot、Hermes、OpenClaw 等工具均有独立的配置文档,各自有不同的模型配置模式。在网关前端对接多种 agent 工具的团队,应将此视为 DeepSeek 将 Anthropic 兼容端点定位为 agent 工作负载主力后端的明确信号,并据此规划路由策略。
路由网关视角的操作建议
对于在 DeepSeek Anthropic 兼容端点前端运行 AI 网关的团队,核心决策在于:是在网关层路由,还是将模型选择委托给环境变量层。
通过网关路由至 DeepSeek: 若网关负责翻译 Claude 模型名并转发至 DeepSeek Anthropic 端点,服务端映射表会控制最终模型分配。网关层无法区分 V4 Pro 与 V4 Flash——映射仅由请求 Claude 模型名前缀决定(opus→pro,sonnet/haiku→flash)。若这一粗粒度拆分符合你的成本和质量目标,该方案完全可行。
环境变量层直接指定(绕过网关抽象): 官方配置明确写出 ANTHROPIC_MODEL=deepseek-v4-pro[1m],这会覆盖 Claude Code 通常从映射表中选取的模型——但子 agent 调用(通过 CLAUDE_CODE_SUBAGENT_MODEL)仍独立路由至 flash 层。
混合 agent 团队的推荐路由策略:
- 为 Claude Code 及所有 Opus 层工具设置编排器模型为
deepseek-v4-pro[1m] - Sonnet/Haiku 层子 agent 调用路由至
deepseek-v4-flash,不加[1m]后缀 - 在成本归因中单独核算 Web 搜索的第二次调用计费
- 若你在网关前端对接多款 agent 工具,建议逐一查阅 15 个官方集成文档——各工具的模型配置模式可能不同
TheRouter 用户需关注的内容
DeepSeek Anthropic 兼容端点的行为——包括模型映射表和 [1m] 说明符——与任何通过 TheRouter 将 Claude Code 或其他 Anthropic SDK 工具路由至 DeepSeek 上游的团队密切相关。请确认你的提供商路由配置能正确处理 Anthropic 端点格式,并且成本核算已涵盖主调用和 Web 搜索触发的第二次计费。DeepSeek 提供商配置文档涵盖基础 URL 和认证配置;本文所述的模型说明符细节是需要在网关层之上独立管理的运营配置。
相关阅读
AI 路由新闻与供应商动态 →
DeepSeek 弃用 deepseek-chat 模型名称:V4 Flash 迁移与 Anthropic API 路由新路径
DeepSeek 将于 7 月 24 日废弃 deepseek-chat 和 deepseek-reasoner 模型名称,同时推出 Anthropic API 格式端点。以下是 AI 工程团队的路由迁移指南。

DeepSeek Claude Code & OpenCode 集成:V4 API 官方配置指南
DeepSeek 官方 Claude Code、OpenCode 与 OpenClaw 集成指南 — API 配置、按层级 V4 模型路由、Anthropic 兼容端点设置,适用于编程智能体。

Claude Code 2.1.275 让每个网关代理都返回 400。2.1.276 当天就修好了。
2.1.275 引入的一个内部请求 tag 导致所有通过 ANTHROPIC_BASE_URL 代理的调用全部返回 400。2.1.276 数小时后作为定向 hotfix 发布。本文拆解这次故障的机制、受影响配置,以及 2.1.275 中值得审查的三处次要 operator 变更。