OpenRouter 替代方案 2026:开发者 LLM 网关对比指南
2026 年 OpenRouter 替代方案对比——LiteLLM、Portkey、Cloudflare AI Gateway 和 TheRouter——从定价、模型覆盖、fallback 路由、OpenAI SDK 兼容性和自托管部署五个维度展开。
如果你在 2026 年评估 OpenRouter 替代方案,大概率是遇到了这几个问题之一:5.5% 平台费在流量放大后成了显著成本;合规或数据驻留要求必须自托管网关;或者你需要比"传一个 model 数组做 fallback"更精细的路由控制。我们经历过同样的评估,所以整理了这份对比——覆盖开发者在搜索 OpenRouter 替代品时最常遇到的五个网关。
OpenAI 兼容指供应商提供一个 chat-completions 接口,其请求与响应结构与 OpenAI API 契约足够接近——只需替换三个值(API key、base URL、模型名),原来的 OpenAI SDK 调用即可直接工作。最小实践面是POST /v1/chat/completions 带 messages、model, 并返回 OpenAI 形式的流式响应。
快速对比表
| 特性 | OpenRouter | LiteLLM | Portkey | Cloudflare AI Gateway | TheRouter |
|---|---|---|---|---|---|
| 部署方式 | 仅托管 | 自托管(开源)或 Enterprise | 托管 + 开源网关 | 托管(Cloudflare 边缘) | 托管 |
| 定价模型 | 供应商费率 + 5.5% 平台费 | 免费(开源);Enterprise 按年容量计费 | 免费层 → $49/月 Production → Enterprise 定制 | 核心免费;Workers Paid $5/月可扩展日志额度 | 按用量计费 |
| OpenAI SDK 兼容 | 是(/api/v1/chat/completions) | 是(直接代理) | 是(Universal API) | 是(URL 前缀重写) | 是(路由 OpenAI 兼容请求) |
| 供应商数量 | 50+ | 100+(自行配置) | 250+(通过 virtual keys) | 任意(URL 重写,不绑定供应商) | 已配置的供应商 |
| Fallback 路由 | route: 'fallback' + model 数组 | YAML 配置 fallback | 网关配置自动 fallback | 手动(需自写 Worker 逻辑) | 在产品路径支持时提供 fallback |
| 自托管 | 否 | 是(核心产品) | 是(开源网关) | 否(仅 Cloudflare 边缘) | 否 |
| 可观测性 | 仪表盘 + 用量 API | Prometheus 指标、请求/响应日志 | 日志、Trace、反馈、自定义元数据 | 仪表盘分析、持久化日志 | 统一计费/核算面板 |
| 免费层 | 28+ 免费模型,20 RPM | 无限(自托管) | 10k 记录日志/月,3 天保留 | 100k 日志总量(Free 计划) | N/A |
来源:OpenRouter 文档(检索于 2026-07-29)、LiteLLM 定价(检索于 2026-07-29)、Portkey 定价(检索于 2026-07-29)、Cloudflare AI Gateway 定价(检索于 2026-07-29)。
为什么开发者要找 OpenRouter 替代方案
OpenRouter 解决了一个真实痛点:一个 API key、多个模型、无需为每个供应商单独开户。但三种模式会让团队开始考虑替代品:
规模化后的成本。 OpenRouter 在信用额度购买上收取 5.5% 平台费。低流量时无感。月均 1000 万+ token 之后,这笔费用就变成值得优化的成本项——尤其当你已经持有供应商的直接 API key 时。
部署控制。 受监管行业、数据驻留要求和隔离网络环境需要自托管网关。OpenRouter 仅提供托管服务,没有自托管选项。
路由精细度。 OpenRouter 的 route: 'fallback' 加上 model 数组覆盖了基础场景。但团队如果需要加权负载均衡、基于成本的路由、延迟感知选择或供应商级别的重试策略,就会超出它的能力范围。
这些都不是每个人的硬伤。如果 OpenRouter 的模型覆盖和托管便利性刚好满足你的工作负载,它仍然是靠谱的选择。下面的对比面向的是上述某个约束已经成为阻塞点的团队。
逐项对比:定价模型与免费层
OpenRouter
OpenRouter 透传供应商的 per-token 费率,不加 per-token markup。平台在信用额度购买时收取 5.5% 费用(单次购买最低 $0.80)。BYOK(自带 key)使用会有 5% 尾费。免费层用户可以使用 28+ 免费模型,RPM 上限 20,每天 50–1,000 次请求(取决于具体模型)。
来源:OpenRouter pricing blog(检索于 2026-07-29)。
LiteLLM
LiteLLM 的开源代理永久免费自托管——无许可证费、无 per-token 费用。你在 YAML 文件中配置自己的供应商 API key。Enterprise 层在同一网关基础上增加 SSO、SCIM、审计日志、密钥管理器集成、多区域控制面板和 24/7 支持。Enterprise 定价基于年网关请求容量和部署架构,从不按 token 计费。
来源:LiteLLM 定价页(检索于 2026-07-29)。
Portkey
Portkey 提供免费 Developer 层(每月 10,000 条记录日志,3 天日志保留)。Production 层 $49/月,包含 100,000 条记录日志、30 天日志保留、LLM guardrails、无限 prompt 模板和 RBAC。Enterprise 定制定价,起步 1000 万+ 记录日志/月,支持自定义保留期、SSO、私有云部署和 SOC2/GDPR/HIPAA 合规选项。超出日志限额不会阻断请求——只有超额日志不被记录。
来源:Portkey 定价页(检索于 2026-07-29)。
Cloudflare AI Gateway
Cloudflare AI Gateway 核心功能——仪表盘分析、缓存和速率限制——在所有计划上免费。日志存储随 Cloudflare Workers 计划扩展:免费计划 100,000 条日志总量,$5/月 Workers Paid 计划每个 gateway 10,000,000 条日志。Unified Billing(通过 Cloudflare 购买供应商信用额度)收取 5% 费用,供应商推理价格原价透传。Guardrails 使用 Workers AI 上的 Llama Guard 3,按 Workers AI 推理计费。
来源:Cloudflare AI Gateway 定价(检索于 2026-07-29)。
TheRouter
TheRouter 通过已配置的供应商路由 OpenAI 兼容请求,并在已实现的场景下提供统一计费和核算面板。按用量计费。
逐项对比:模型覆盖与供应商广度
OpenRouter 聚合了 50+ 供应商和数百个模型到一个 API key 背后。你不需要直接的供应商账号——OpenRouter 管理凭证。代价是模型可用性取决于 OpenRouter 的集成节奏;新模型可能滞后于供应商发布数小时或数天。
LiteLLM 支持 100+ 供应商,但需要你提供自己的 API key。覆盖范围取决于你的供应商合同。LiteLLM 维护了一个模型成本映射表,追踪各供应商支持模型的价格,使得跨供应商的开支跟踪无需手动配置即可工作。
Portkey 声称通过 Universal API 提供 250+ 供应商集成。和 OpenRouter 类似,你可以使用 Portkey 托管的 key 或自带 key。Virtual keys 在网关层面抽象了供应商凭证。
Cloudflare AI Gateway 在设计上不绑定供应商——它在边缘重写 URL。你将它指向任意供应商端点,Cloudflare 代理请求。这意味着它可以与任何接受 HTTP 请求的供应商配合使用,但所有供应商关系由你自行管理。
TheRouter 通过已配置的供应商路由请求,支持模型路由和 fallback。供应商覆盖取决于配置的路由表。
逐项对比:Fallback 路由与可靠性特性
Fallback 路由——当主供应商或模型失败时自动在另一个上重试——是区分网关和简单 API 代理的关键特性。
OpenRouter 通过 models 数组加 route: 'fallback' 支持 fallback。如果第一个模型返回错误,OpenRouter 会尝试数组中的下一个。这覆盖了"主模型挂了,试备选"的基础场景。可以通过 provider 参数指定供应商级别的路由偏好。
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key="sk-or-...",
)
response = client.chat.completions.create(
model="openai/gpt-4o",
messages=[{"role": "user", "content": "Hello"}],
extra_body={
"models": ["openai/gpt-4o", "anthropic/claude-sonnet-4", "google/gemini-2.5-flash"],
"route": "fallback",
},
)
LiteLLM 在代理配置中支持 fallback 列表、重试和超时。你在 YAML 配置中定义 fallback 模型、设置重试次数和超时阈值。因为是自托管的,你可以控制重试逻辑,包括供应商级别的重试策略和通过自定义回调实现的断路器。
model_list:
- model_name: gpt-4o
litellm_params:
model: openai/gpt-4o
api_key: sk-...
- model_name: gpt-4o
litellm_params:
model: anthropic/claude-sonnet-4
api_key: sk-ant-...
litellm_settings:
num_retries: 3
request_timeout: 30
Portkey 通过网关配置提供自动 fallback、负载均衡、重试和超时。Fallback 目标可以包含不同的供应商、模型甚至不同的 Portkey virtual key。网关在边缘处理路由决策。
Cloudflare AI Gateway 不包含内置 fallback 路由。你需要在网关前面的 Cloudflare Worker 中自行实现 fallback 逻辑——完全可控但需要写更多代码。
TheRouter 在产品路径支持时提供供应商/模型路由和 fallback。
逐项对比:OpenAI SDK 兼容性深度
五个网关都接受 OpenAI 格式的请求。差异在于它们对完整 OpenAI API 表面的支持深度:
| 能力 | OpenRouter | LiteLLM | Portkey | Cloudflare AI Gateway | TheRouter |
|---|---|---|---|---|---|
| Chat completions | 是 | 是 | 是 | 是(透传) | 是 |
| 流式输出 | 是 | 是 | 是 | 是 | 是 |
| Tool calling | 是(为非 OpenAI 供应商做转换) | 是(跨供应商映射) | 是 | 是(透传) | 是 |
结构化输出 / response_format | 是 | 是 | 是 | 是(透传) | 是 |
| Embeddings | 是 | 是 | 是 | 是(透传) | 是 |
| 图像生成 | 是 | 是 | 是 | 是(透传) | 通过 /v1/jobs/:id 支持异步媒体任务 |
实际检验:你能不能只改 base_url 就让 OpenAI SDK 客户端正常工作?对于 chat completions 和流式输出,五个都可以。对于供应商特有参数、响应字段保留和边缘错误映射等高级特性,需要用你的具体模型测试。
逐项对比:自托管 vs 托管部署
这是最尖锐的差异点:
自托管选项:
- LiteLLM——核心产品就是自托管代理。通过 Docker、Kubernetes 或裸金属部署。Enterprise 支持隔离网络部署。你的数据和 API key 不会离开你的基础设施。
- Portkey——提供开源网关用于自托管,包含 Universal API、重试、路由、guardrails 和基础仪表盘。完整功能集(高级 guardrails、治理、SSO)需要托管平台或 Enterprise 自托管部署。
仅托管:
- OpenRouter——无自托管选项。所有流量经过 OpenRouter 基础设施。
- Cloudflare AI Gateway——运行在 Cloudflare 边缘网络上。无自托管版本,但你的供应商 API key 存储在你的 Cloudflare 账户中。
- TheRouter——托管服务。
如果数据驻留或隔离网络部署是硬性要求,LiteLLM 是最强选项。如果你想要托管便利性并保留退出路径,Portkey 的开源网关提供了中间方案。
决策矩阵:你需要 X,就选 Y
| 如果你需要… | 考虑 |
|---|---|
| 最快上手、无需供应商账号、最大模型广度 | OpenRouter——一个 API key,50+ 供应商,有免费模型 |
| 自托管网关、完全基础设施控制、零平台费用 | LiteLLM——免费开源代理,100+ 供应商,你的 key |
| 托管网关 + 可观测性、guardrails 和 prompt 管理 | Portkey——$49/月 Production 层覆盖大多数团队需求 |
| 边缘缓存、DLP 扫描、Cloudflare 生态集成 | Cloudflare AI Gateway——核心功能免费,按日志量付费 |
| OpenAI 兼容路由 + 供应商 fallback + 统一计费 | TheRouter——通过已配置供应商路由请求,支持 fallback |
TheRouter 如何适配
TheRouter 通过已配置的供应商路由 OpenAI 兼容请求。当你将 OpenAI SDK 指向 TheRouter 端点时,它处理供应商选择和 fallback 路由(在支持的场景下)。统一计费和核算面板让你在一个视图内查看跨供应商的开支。
from openai import OpenAI
client = OpenAI(
base_url="https://api.therouter.ai/v1",
api_key="your-therouter-key",
)
response = client.chat.completions.create(
model="openai/gpt-4o",
messages=[{"role": "user", "content": "Hello"}],
)
从 OpenRouter(或任何 OpenAI 兼容网关)迁移只需改 base_url 和 api_key。不换 SDK,不改请求格式。
想看更全面的网关级对比(涵盖架构和可观测性),参阅我们的统一 LLM API 供应商与网关对比 2026。
常见问题
OpenRouter 的 5.5% 费率是 per-token 还是 per-purchase? 按信用额度购买收取。OpenRouter 透传供应商 token 费率,不加 per-token markup。5.5% 在你购买信用额度时收取(单次购买最低 $0.80)。BYOK 使用有单独的 5% 尾费。来源:OpenRouter 定价(检索于 2026-07-29)。
LiteLLM 能完全免费使用吗? 可以。开源代理可以永久免费自托管,无许可证费。你只需支付供应商 API 费用。Enterprise 在同一网关之上增加治理、SSO 和支持,按年请求容量定价。来源:LiteLLM 定价(检索于 2026-07-29)。
Cloudflare AI Gateway 会在供应商 token 价格上加价吗? 不会。供应商推理价格原价透传。Cloudflare 的 Unified Billing 在信用额度购买上收取 5% 费用(和 OpenRouter 的模型类似)。核心网关功能免费。来源:Cloudflare AI Gateway 定价(检索于 2026-07-29)。
哪个网关的免费层最适合原型开发? 托管方面:OpenRouter(28+ 免费模型)或 Cloudflare AI Gateway(免费分析、缓存、速率限制)。自托管方面:LiteLLM(无限、永久免费)。Portkey 免费层每月覆盖 10k 记录日志。
从 OpenRouter 迁移到其他网关需要改应用代码吗?
大多数情况下不需要。五个网关都支持 OpenAI chat completions 格式。迁移通常只需改 base_url 和 api_key。模型 ID 在不同网关之间可能不同,迁移前需要对照目标网关的模型列表确认。参阅我们的 OpenAI 到 TheRouter 迁移指南获取分步操作。
本文引用来源:OpenRouter API 文档、OpenRouter free LLM APIs comparison、LiteLLM 定价、LiteLLM GitHub、Portkey 定价、Cloudflare AI Gateway 定价、Cloudflare AI Gateway 概览。全部检索于 2026-07-29。