
Gemini Managed Agents 新增后台执行与远程 MCP:每位 Operator 必须完成的路由架构调整
Google 于 7 月 7 日为 Gemini Managed Agents 添加了后台执行(background execution)和远程 MCP server 集成。两项更新改变了 operator 在生产 agent pipeline 中设计轮询循环、超时策略和工具编排的方式。

Google 于 7 月 7 日为 Gemini Managed Agents 添加了后台执行(background execution)和远程 MCP server 集成。两项更新改变了 operator 在生产 agent pipeline 中设计轮询循环、超时策略和工具编排的方式。

Google Nano Banana 2 Lite(gemini-3.1-flash-lite-image)于 6 月 30 日发布,$0.034/千张,4 秒延迟。如果你仍在路由至 gemini-2.5-flash-image,你用的是上上代模型。本文提供每个图像管线团队需要的三层路由框架。

Google 于 7 月 1 日正式发布(GA)多个待处理 Provisioned Throughput 订单功能——你现在可以同时为同一模型和地区提交最多 7 个订单,彻底消除了过去每次等待 10 个工作日才能激活下一个订单的串行瓶颈。

2026 年 Gemini API 图像生成已进入两波迁移:6 月 25 日后 preview 图像模型会触发 failed to fetch 类故障,Imagen 4 GA endpoint 将于 8 月 17 日停服。现在应审计模型 ID,迁到 gemini-3.1-flash-image 或 gemini-3-pro-image,并测试 generateContent 调用链路。

2026 年 7 月 1 日起,Gemini 3 及以上版本对非全球(区域)端点收取 10% 溢价。将流量路由至 eu-west1、asia-northeast1 等非全球位置的团队需立即审查成本模型。

Google 已于 2026 年 6 月 19 日起停止接受无限制 Gemini API Key 的请求。任何未配置显式 API 限制的 Key 现在会返回错误。以下是通过 gateway 路由 Gemini 流量的 operator 需要立即审查的凭据配置。

Google 的 Gemini Enterprise 本周将 workflow agents 与可复用 skills 推进至 GA,两者均需申请 allowlist。本文梳理架构决策树,以及这对企业 AI 工程团队的路由规划意味着什么。

Gemini Memory Bank(Agent Platform 记忆库)是 Google 为 AI Agent 提供的托管式持久记忆层,6 月 17 日正式 GA 并开放全球端点。本文详解 agent platform memory bank 的工作原理、Session 机制、CMEK 约束,以及有状态 Agent 路由策略。

Gemini CLI 将于 2026 年 6 月 18 日停止服务消费端请求。在默认迁移到 Antigravity CLI 之前,先搞清楚 unified-backend 模型对 provider 独立性意味着什么——以及 Claude Code 或 Codex CLI 的多 provider routing 如何改变这道选择题。

Google Gemini 3.5 Live Translate 通过 Gemini API 开放公开预览,支持 70+ 种语言的连续语音对语音翻译。新模型 ID 对语音 agent 路由团队意味着什么。

谷歌每月9.2亿美元租用SpaceX GPU,说明Gemini算力并非无限。AI团队应重新评估供应商关联故障、2026年第四季度配额变化与多供应商备用路径。

Gemini 2.0 Flash 与 Flash-Lite 已于 2026 年 6 月 1 日完成关停。本文说明哪些模型 ID 已被移除、哪些替代方案(gemini-2.5-flash-lite、gemini-3.1-flash-lite)真正可用、实际成本差距,以及如何最快速地审计可能仍引用已失效 endpoint 的 fallback 链。

Google 在 I/O 2026 发布的 Gemini 3.5 Flash 定价为每百万 token 输入 $1.50 / 输出 $9.00,是上一代 Flash 模型的 3-6 倍。这次定价重构,加上新推出的 Interactions API,意味着「Flash = 便宜备用」的路由逻辑已经失效。