DeepSeek V4 峰谷定价:时间维度成为每个 AI 网关必须支持的路由参数

DeepSeek V4 将于 7 月中旬正式发布,首次引入高峰时段 API 价格翻倍的峰谷定价机制。每一个 AI 路由层现在都需要支持时区感知的成本计算和降级逻辑。

发布于 来源 DeepSeek / TechNode

归档条目:由 AI 根据所引信源辅助生成,发布时未经逐篇审阅。责任编辑:Joe Werner。

一个叠加在网络路由图上的时钟表盘,高峰时段区域高亮显示 DeepSeek API 流量的 2× 定价

DeepSeek V4 的发布带来的不只是更强的模型。它将迫使每一个 AI 网关、代理和路由层增加一个从未需要过的维度:时间。从 7 月中旬开始,DeepSeek V4 API 在高峰时段(北京时间 9:00–12:00 和 14:00–18:00)的 per-token 价格翻倍,非高峰时段则维持标准费率。这是主流 AI 模型提供商首次在 API 层面引入峰谷定价,它永久改变了路由的游戏规则。

发生了什么

2026 年 6 月 30 日,DeepSeek 团队宣布 V4 正式版将于 7 月中旬发布,带来三个关键变化:

  1. 完整 V4 能力套件 — 正式版在当前预览版基础上进一步提升了 agent 执行、数学推理和代码生成能力,全系列模型标配 100 万 token 上下文窗口。
  2. 峰谷 API 定价 — AI API 史上首次,主流提供商将在每日两个窗口期收取 2 倍标准费率:北京时间 9:00–12:00 和 14:00–18:00(UTC 01:00–04:00 和 06:00–10:00)。
  3. 非高峰标准费率 — 窗口之外,定价维持在 5 月公布的最新 V4 Flash/Pro 费率。

此前,DeepSeek 在过去两个月进行了大幅降价,包括 5 月宣布的 V4 Pro API 永久 75% 折扣。高峰加价实质上是部分回调——信号很明确:价格战无法在最繁忙时段维持无限容量。

为什么这对 AI 工程团队很重要

时间驱动的定价从未成为 AI API 选择的一个因素。团队目前基于模型质量、成本、延迟和可用性来路由请求——这些都是静态或准静态维度。引入时间维度意味着:

每个在亚洲工作时间运行生产 AI 工作负载的团队都将看到 DeepSeek 账单变化。 如果你的 CI 流水线在北京时间上午 10 点触发,下午编码窗口使用推理模型,或者面向客户的聊天机器人在午餐时段达到高峰——这些调用在 DeepSeek V4 上现在要贵一倍。

成本预测变得更难。 大多数团队的成本模型假定统一的 per-token 费率。DeepSeek 的两级定价意味着准确预测成本需要了解 API 流量的时间分布。一个高峰时段占比 60% 的工作负载,其成本比相同 token 量在非高峰时段高出 40%——这种差距会随着规模放大。

供应商选择获得了时间维度。 如果 DeepSeek 的峰谷定价在容量管理上效果显著,其他供应商也会跟进。今天不支持时间感知供应商选择的路由层,在第二个供应商宣布峰谷定价时将面临架构升级。

路由与运维视角

这不是一次小的定价调整。这是对 API 路由基础设施的一次品类定义性改变:

路由表现在需要一个时钟。 每个 AI 网关——包括 TheRouter——都需要理解请求相对于供应商时区的时间点。北京时间上午 10 点,DeepSeek V4 的费用翻倍。北京时间晚上 8 点,回到标准费率。一个偏爱 DeepSeek 处理成本敏感型工作负载的路由策略,不能再统一应用同一规则。

时区感知的账单对账。 大多数计费面板按模型和日期聚合成本。DeepSeek 的峰谷定价迫使更细粒度的成本归因:按模型 × 日期 × 小时。需要对接多个供应商账单的企业团队,将需要这种粒度来准确归集成本。

降级逻辑获得时间检查。 如果 DeepSeek V4 是你的主力模型,但其高峰费率超过了你备用供应商的固定费率,你的路由策略应该在高峰时段跳过 DeepSeek,直接路由到更便宜的替代方案。这个决策必须按请求做出,并具备时钟感知——而不是在部署配置阶段。

100 万上下文窗口放大了定价影响。 一个在高峰时段填满 50 万 token 输入的单次长上下文调用,其成本将远高于非高峰时段的同一调用。对于构建 RAG 流水线或带有大型 system prompt 的 agent 工作流的团队来说,将批处理或长时间 agent 运行调度到非高峰时段是一种成本控制手段。

TheRouter 用户应该关注和尝试的方向

TheRouter 的路由引擎支持按供应商成本权重,我们的计费管道已经以秒级粒度追踪每个请求的成本。随着 DeepSeek 推出时间驱动定价,以下是你应该关注的方向:

  • 审计你的 DeepSeek 流量模式。 检查定价生效后,你的 DeepSeek API 流量中有多少百分比落入高峰窗口。如果高峰窗口占比超过 40%,考虑在这些时段调整你的路由权重。
  • 设置基于时间的降级策略。 当 DeepSeek 进入高峰定价时,你的成本最小化路由规则应该自动选择固定定价供应商来处理符合条件的请求——同时不牺牲质量阈值。
  • 密切关注供应商公告。 如果 DeepSeek 的峰谷定价减少了中国工作时间段的队列深度,其他供应商可能会采用类似模型。具备时间感知路由基础设施的团队将比没有的团队更快适应。

API 峰谷定价对 AI 领域来说是新事物,但对每个管理过预留实例、spot 定价和分时计算折扣的云基础设施团队来说却很熟悉。DeepSeek 刚刚将这种模式带到了模型推理领域。路由 AI 流量的网关和代理需要尽快跟上。

编辑风格插图,展示分叉的 API 路由路径,其中标有 agents sessions 的分支偏离主网关,背景为低饱和深色调

OpenAI Agents API 公测:网关运营商需要正视的新绕道路径

OpenAI 的 Agents API 公测版引入了 client.beta.agents 这个独立命名空间,它根本不经过 /v1/chat/completions。对于通过 AI 网关路由流量的团队来说,这意味着账单盲区、缺失的审计记录,以及一个需要单独管理的 API key 权限范围。

来源 OpenAI
帮助与联系