2026 Gemini API 图像生成迁移:修复 failed to fetch,并准备 8 月 17 日停服
2026 年 Gemini API 图像生成已进入两波迁移:6 月 25 日后 preview 图像模型会触发 failed to fetch 类故障,Imagen 4 GA endpoint 将于 8 月 17 日停服。现在应审计模型 ID,迁到 gemini-3.1-flash-image 或 gemini-3-pro-image,并测试 generateContent 调用链路。

两个 Gemini 图像 API 停机截止日期同时进入倒计时。第一个仅剩五天。如果你的 pipeline 仍在调用预览版图像模型 ID,6 月 25 日之后它将停止响应。第二个——影响 Imagen 4 GA endpoint——给你留到 8 月 17 日完成迁移。两波变化都要求今天就做出路由决策,而不是等到 on-call 告警时再处理。
发生了什么
Google 官方 Gemini API changelog 列出了来自 2026 年 5 月和 6 月的两条废弃公告,影响图像生成模型 ID:
第一波 — 2026 年 6 月 25 日(紧急):
gemini-3.1-flash-image-preview— 停止服务gemini-3-pro-image-preview— 停止服务
这两个模型于 2026 年 5 月 28 日被标记为废弃,同日 Google 发布了正式 GA 替代版本:gemini-3.1-flash-image(Nano Banana 2)和 gemini-3-pro-image(Nano Banana Pro)。预览版 ID 的最短通知期为两周;6 月 25 日是硬性截止时间。
第二波 — 2026 年 8 月 17 日(规划窗口):
imagen-4.0-generate-001imagen-4.0-ultra-generate-001imagen-4.0-fast-generate-001
这些是 Imagen 4 GA endpoint,于 2026 年 6 月 15 日宣布废弃。完整迁移路径尚未发布,但官方 Gemini 废弃页面将持续更新指南。使用 Imagen 4 endpoint 的团队还有约八周时间。
为何 AI 工程团队需要关注
图像生成越来越多地嵌入生产级 AI pipeline 中——用于生成缩略图、品牌素材、报告信息图或 UI 原型的多模态 agent。这里的废弃模式有两个特性,使其比一般的模型下线更具风险:
两波废弃,两种不同的响应码。 一旦预览版模型 ID 于 6 月 25 日停止服务,API 调用将返回错误响应——而不是优雅降级。配置中仍使用预览版 ID 而非 GA ID 的团队将遭遇硬性失败,而非质量下降。这与模型被静默重定向的软废弃方式不同。
Imagen 4 的情况不同。 Imagen 4(imagen-4.0-*)endpoint 是正在被替代的 GA 模型,而非预览版转 GA 升级路径;这是 GA 到下一代的过渡。当前 Gemini 图像系列中的候选替代品与替代第一波预览版的模型相同:gemini-3.1-flash-image 和 gemini-3-pro-image。Imagen 4 与这些原生 Gemini 模型在能力上高度重合——两者均支持文字渲染,Flash Image 模型还支持视频转图像——但 API 合约不同:Imagen 4 使用 imageGeneration capability 路径,而 Gemini 3.x 图像模型使用标准 generateContent API。
路由配置需要两次独立更新。 今天通过将预览版 ID 换成 GA ID 来修复第一波问题的团队,并没有解决第二波。8 月 17 日还需要第二次迁移。
路由层/operator 视角
如果你通过代理或 gateway 路由图像生成请求,废弃问题会在路由层而非应用层产生模型 ID 审计需求:
审计你的模型 ID 许可列表。 任何引用 gemini-3.1-flash-image-preview、gemini-3-pro-image-preview 或任何 imagen-4.0-* 变体的路由表、模型别名或 fallback 链都需要分两次更新。预览版 ID 应在 6 月 25 日前退役;Imagen 4 ID 应在 8 月 17 日前迁移。
第一波废弃同样影响 Firebase AI Logic。 Firebase AI Logic SDK 原先路由到即将下线的 Imagen 模型——Firebase 官方文档明确指出,该 SDK 下的所有 Imagen 模型均已废弃,关停日期为 6 月 24 日。在移动或 Web 应用中使用 Firebase 生成图像的团队需迁移至 Gemini 图像 SDK 路径。
第一波替代版本与第二波的模型对等性。 替代预览版的 GA Gemini 图像模型(gemini-3.1-flash-image、gemini-3-pro-image)也是 Imagen 4 部分迁移的目标模型。这意味着你的路由策略可以收敛而非扩张:你是在迁移到更少、更受支持的模型 ID,而非碎片化到更多 provider。
generateContent 与 Imagen endpoint 的 API 接口差异。 如果现有 pipeline 是基于 Imagen 4 endpoint 格式构建的,迁移到 gemini-3-pro-image 不仅仅是换一个模型 ID 字符串,还需要修改 API 调用格式。请在 8 月 17 日之前留出集成测试周期。
TheRouter 用户的关注点与建议
如果你通过 TheRouter 路由图像生成调用,请对照两个停机日期检查已配置的模型 ID。路由策略变更很直接:替换预览版模型 ID 字符串,并在废弃日历中标记 Imagen 4 endpoint 的 8 月 17 日截止时间。
对于正在构建多 provider 图像路由的团队——例如,根据内容类型或成本在 Gemini 图像模型和 DashScope 的 wan2.7-image-pro 之间切换——6 月 25 日的切换节点是验证 fallback 配置的好时机。如果 fallback 链将预览版模型 ID 列为备选,当主模型不可用时,这条链在 6 月 25 日之后将静默失败。
我们此前报道了 Vertex AI Imagen 和 Veo endpoint 废弃(6 月 30 日停机)。本文中的 Gemini API 废弃是独立的系统,使用不同的模型 ID、不同的 endpoint 路径和不同的停机日期,两者都需要关注。
Operator 操作清单
6 月 25 日前:
- 在代码库、配置文件和路由表中搜索
gemini-3.1-flash-image-preview和gemini-3-pro-image-preview - 分别替换为
gemini-3.1-flash-image(Flash 级)或gemini-3-pro-image(Pro 级) - 重新运行集成测试;GA API 合约稳定,但值得在具体环境中确认
8 月 17 日前:
- 审计所有
imagen-4.0-generate-001、imagen-4.0-ultra-generate-001和imagen-4.0-fast-generate-001引用 - 确定目标迁移路径——
gemini-3.1-flash-image覆盖了大多数 Imagen 4 使用场景,包括文字渲染和视频转图像 - 如果 pipeline 使用了 Imagen 专有 endpoint 格式,需处理 API 格式变更
- 持续关注官方迁移指南在 Gemini 废弃页面 发布后的更新
这里的两波结构对于成熟的多模态 API 而言并不罕见,但五天截止日期与八周规划窗口的同步并存,使其成为一个需要优先级排序的决策,而非单纯的迁移任务。
相关阅读
AI 路由新闻与供应商动态 →
Nano Banana 2 Lite 是你的新默认 Gemini 图像端点 — 三层路由决策框架
Google Nano Banana 2 Lite(gemini-3.1-flash-lite-image)于 6 月 30 日发布,$0.034/千张,4 秒延迟。如果你仍在路由至 gemini-2.5-flash-image,你用的是上上代模型。本文提供每个图像管线团队需要的三层路由框架。

Gemini 预置吞吐量现已支持队列 7 个待处理订单:多订单 GA 对路由团队意味着什么
Google 于 7 月 1 日正式发布(GA)多个待处理 Provisioned Throughput 订单功能——你现在可以同时为同一模型和地区提交最多 7 个订单,彻底消除了过去每次等待 10 个工作日才能激活下一个订单的串行瓶颈。

Gemini 非全球端点定价 7 月 1 日正式生效:每个路由团队必须考量的 10% 区域溢价
2026 年 7 月 1 日起,Gemini 3 及以上版本对非全球(区域)端点收取 10% 溢价。将流量路由至 eu-west1、asia-northeast1 等非全球位置的团队需立即审查成本模型。