OpenRouter 每周 25 万亿 Token 意味着什么:1.13 亿美元融资背后,多模型路由的真正信号

OpenRouter 每周处理量已达 25 万亿 Token,半年增长 5 倍。这个数字意味着什么?对你的路由架构、provider 锁定风险和团队治理有什么直接影响?

发布于 来源 OpenRouter

归档条目:由 AI 根据所引信源辅助生成,发布时未经逐篇审阅。责任编辑:Joe Werner。

抽象编辑风格插图:多模型 AI 路由基础设施,显示 provider 节点与流量走向

标题数字是 1.13 亿美元。真正值得运营团队关注的数字是 5 倍——OpenRouter 在短短半年内,每周 Token 处理量从 5 万亿猛增至 25 万亿。这个增长率,而非融资事件本身,才是你的路由架构应当响应的信号。对于正在设计或评估 AI 基础设施的团队来说,这个数字提供了一个外部校准点:多模型路由在全球范围内的实际使用规模,已经远超大多数内部估算。

当一个 AI gateway 每周处理 25 万亿 Token、覆盖 400 多个模型、服务 800 万用户,估值在 12 个月内从 5.47 亿美元翻倍至 13 亿美元——这说明企业级 AI 流量的实际走向不是单一 provider,而是通过一个多模型控制平面,同时管理成本、延迟和能力路由。

这个规模变化值得和六个月前的基线比较:当时 OpenRouter 每周处理约 5 万亿 Token。5 倍的增长主要来自 agentic 工作负载的扩张——coding agent、多步推理任务、RAG pipeline 以及越来越多的视频/音频/图像多模态请求,这些场景对 token 消耗的复利效应,远超传统的单轮对话请求。

发生了什么

2026 年 5 月 26 日,OpenRouter 宣布完成 1.13 亿美元 B 轮融资,由 CapitalG(Alphabet 独立成长基金)领投,Nvidia 旗下 NVentures、ServiceNow Ventures、MongoDB Ventures、Snowflake Ventures 和 Databricks Ventures 跟投,现有投资方 Andreessen Horowitz 和 Menlo Ventures 也继续参与。

此前仅 12 个月,OpenRouter 完成了估值约 5.47 亿美元的 A 轮融资(2025 年 6 月,融资 4000 万美元,由 Andreessen Horowitz 和 Menlo Ventures 领投,Sequoia 参与)。本轮融资后估值约为 13 亿美元。

OpenRouter 表示,新资金将用于扩展 routing、governance 和优化能力,以满足企业持续推进 AI 生产部署的需求。

该公司公开维护一个模型排行榜,已成为业界广泛参考的真实世界模型采用信号、成本动态和 provider 偏好数据源。

为什么 AI 工程团队需要关注

投资方名单并非偶然:CapitalG(母公司为 Google)、NVentures(Nvidia)、ServiceNow Ventures、MongoDB Ventures、Snowflake Ventures 和 Databricks Ventures,均是企业基础设施领域的核心玩家。他们的共同入局,代表一种共识判断——多模型 routing 基础设施已成为企业 AI 技术栈的永久战略层,而非过渡性补丁。

融资公告引用的 Deloitte 研究数据是最接地气的锚点:67% 的企业每月 Token 消耗量已接近 10 亿。在这个规模下,将流量绑定单一 provider 不是简化策略,而是成本管理失误。以 GPT-5.5 为例,input 费率 $5.00/M tokens,output 费率 $30.00/M tokens;而 Qwen3.7 Max 的 input 费率仅 $2.50/M,output $7.50/M。对于每月消耗 10 亿 token 的企业,仅凭路由策略的优化,理论成本差距可达数倍——前提是你的路由层能够识别任务类型并动态分配。

5 倍增长率对你的团队意味着什么:

  • 你当前规模下的 Token 用量被低估了。 六个月前,团队还能用"用量可控"来合理化 single-provider 方案。但增长曲线表明,随着 agentic 工作负载的复利效应,这个假设很快会失效。
  • 模型选择已从评估问题变成运营问题。 团队在 Qwen3.7 Max($2.50/M input tokens)和 GPT-5.5($5.00/M)之间 routing,并非因为做了充分 eval,而是因为不同任务有不同的成本-性能最优点——六个月前的最优模型,今天可能已不再适用。
  • Governance 与计费是新的瓶颈。 在 400 多个模型之间 routing,如果缺少每请求数据处理策略、团队级访问控制、per-seat 消费上限和可审计的用量报告,将产生合规风险,安全和财务团队在企业审查中会直接否决。

Router/Operator 视角分析

OpenRouter 增长背后隐含的架构命题值得明确说出:推理 routing 是一个持续再优化问题,而非一次性的 vendor 选型。 CEO 的话直截了当:"选定单一模型的时代已经结束。成功取决于在持续变化的市场中不断调整 routing 策略。"

对于正在构建或运营自有 routing 层的团队,这带来了一个架构决策框架:

自建 vs. 托管 routing 控制平面。 基于 OpenAI-compatible SDK 从头实现多模型 routing,需要自行解决:

  1. Provider 健康检查与熔断器(circuit breaker)
  2. 每模型成本核算(不同 provider 的 input/output/cached token 费率各异)
  3. Fallback 链与降级策略(主 provider 被限流或延迟飙升时如何处理?)
  4. 消费上限与团队级配额执行
  5. 支持对账的可审计用量日志

每一项单独解决都不算难,但集成面才是复杂度所在。OpenRouter 用量 5 倍增长说明,大多数团队选择了 gateway 层,而非自建这套技术栈。

延迟与可靠性路由策略。 按成本 routing 是直观的。按延迟 routing 需要实时观测各 provider 的尾延迟并动态排序。按可靠性 routing 需要维护不会引发级联重试风暴的 fallback 链。大多数自研 routing 实现在成本层面做得不错,但在延迟和可靠性分层上投入不足。

值得注意的是,当一个 provider 被 rate limit,最坏的情况不是失败本身,而是当 fallback 链设计不当,大量并发重试请求会同时冲击备选 provider,导致多个 provider 同时进入限流状态。一个健壮的 routing 设计需要专门为这种场景设计保护机制:在 rate-limit 阈值触达之前主动切换 fallback,而不是依赖 HTTP 429 响应后再送回起点。

Governance 层决定企业合同能否签成。 每请求数据处理策略、团队级访问控制、基于角色的模型访问权限、消费可视化仪表板——这些功能让 routing 层能通过法务和采购审查。缺少它们,技术上正确的 routing 实现仍可能在企业审计中被否决。OpenRouter 在融资公告中明确提到,其 governance 功能包括:per-request 数据处理策略、团队级访问和 routing 权限配置、消费封顶、可见性仪表板,以及支持审计的用量报告。这套能力组合恰恰是企业采购清单上最常被要求的部分。

路由团队今天的决策清单:

  • 你是否有反映当前实际费率(而非六个月前估算)的逐 provider 成本核算?
  • 你是否有在主 provider 被限流之前(而非之后)触发的 fallback 策略?
  • 你的 routing 层是否向管理层(而不仅是工程师)暴露团队级消费可见性?
  • 你的 routing 策略能否在不发布代码的情况下更新?
  • 你是否有能与账单对账的 API 用量审计日志?

如果五条中有任何一条无法回答"是",随着 Token 用量增长,你的 routing 架构就积累着运营技术债。每多延迟一个季度解决这些问题,修复成本和业务中断风险就随用量线性增长。OpenRouter 的 5 倍增长说明,大多数团队并没有先解决好这些问题再扩大规模——而是在增长过程中被迫解决。主动建立 routing 治理层,远比被动应急要高效得多。

TheRouter 用户应该关注和尝试什么

OpenRouter 的增长信号验证了 TheRouter 正在解决的核心问题:通过统一计费和 fallback 策略,跨 provider 路由 OpenAI-compatible 请求。

如果你已经在使用 TheRouter,现在是审查 provider 配置的好时机:

  • 检查每个 preset 的主 provider 和 fallback provider 配置是否符合当前预期
  • 确认你的计费仪表板反映了过去 90 天内新增 provider 的最新费率
  • 检查团队的 preset 维度用量对非工程师角色(管理层、财务)是否可见

如果你正在评估自建 routing 层还是使用 gateway,OpenRouter 的增长曲线是有用的参照:它展示了企业规模下托管 gateway 的需求形态,也清晰地表述了企业采购必须具备的 governance 和计费能力。

模型市场的变化速度意味着,你六个月前制定的 routing 策略今天很可能已经过时。今天存在的 Qwen3.7 Max、DeepSeek V4 Pro 和 Gemini 3.5 Flash 定价结构,六个月前都不存在——六个月后,这张清单又会是另一番面貌。一个连计费等基础数据都需要手动更新的 routing 配置,是你运营风险的来源,不是企业起步阶段的合理选择。

OpenRouter 的 Series B 融资公告实质上是一份来自资本市场的市场调研报告:它告诉你,构建可维护、可审计、可横向扩展的多模型路由控制平面,正在成为企业 AI 基础设施的标配。越早为这个方向建立清晰的架构思路,后续迁移和扩容的成本就越低。

帮助与联系