返回模型列表

Gemini 3 Pro Image

googlegoogle/gemini-3-pro-image

Google's GA image generation model built on Gemini 3 Pro. Premium multimodal image-gen model with creative and design capabilities. Replaces gemini-3-pro-image-preview.

Gemini 3 Pro Image(也称 Nano Banana Pro)是 Google 面向专业视觉工作的 GA 级推理驱动图像生成与编辑模型。Google 将其定位为最强的 Gemini 图像模型,适合复杂多轮生成、图像编辑、图文交错输出,以及需要模型先理解布局再渲染的提示词。

从规格上看,它是文本和图像双输入/双输出模型,提供 65,536 token 上下文窗口、32,768 最大输出 token、每个提示最多 14 张输入图、1K/2K 输出以及预览版 4K 输出、C2PA 内容凭证、Google 搜索 grounding、批量推理和 Provisioned Throughput。该模型不支持音频、视频、Gemini Live API、函数调用、结构化输出、微调,也不支持 Google 原生侧的 OpenAI chat completions。

通过 TheRouter 使用时,Gemini 3 Pro Image 应被视为高端异步图像模型:调用 OpenAI 兼容 Images API 路径,设置 model: "google/gemini-3-pro-image",使用 ?async=true 提交并轮询返回的任务。Google 标准端点定价为 $2/M 输入 token、$12/M 文本输出 token、$120/M 图像输出 token;1K 和 2K 图像消耗 1,120 个图像输出 token,4K 消耗 2,000 个。

适合使用
  • • 需要提示词推理的专业图像生成 —— 海报、营销主视觉、产品图、技术示意图,以及约束很多的视觉概念
  • • 多轮图像编辑 —— 在设计审阅中连续修改源图,而不是每次从零生成
  • • 参考图密集的创意工作流 —— 每个提示最多 14 张输入图,可用于风格、产品、角色或版式参考
  • • 需要 C2PA 凭证、global 区域访问、批量推理和 Provisioned Throughput 的企业级图像管线,而不是玩具级交互工具
不适合使用
  • • 低成本草稿生成 —— 图像输出为 $120/M token(Google 标价下 1K/2K 为 $0.134,4K 为 $0.24);批量构思请改用 Gemini 3.1 Flash Image 或更低成本图像模型
  • • 实时或同步用户流程 —— 图像任务可能超过边缘请求时限,生产集成应使用 TheRouter 的异步提交与轮询模式
  • • 工具调用 agent、JSON 抽取、embedding、音频或视频 —— 该模型专注文本/图像生成与编辑,不是通用 chat-agent API
上下文长度
66K
最大输出
33K
输入价格每百万 tokens
$2.19每百万 Tokens
输出价格每百万 tokens
$131.65每百万 Tokens

模态能力

文本图像→文本图像

能力

视觉理解图像生成

价格明细

类型费率
输入$2.19 每百万 Tokens
输出$131.65 每百万 Tokens

Single blended output rate = the image-output rate ($120/MTok). Google also publishes a separate text/thinking output rate of $12/MTok that this schema cannot express, so non-image output tokens are over-billed. Source: ai.google.dev/gemini-api/docs/pricing, read 2026-07-29.

支持参数

temperaturemax_tokenstop_presponse_formatstop

模型规格

发布阶段GAdocs.cloud.google.com ↗已核实
发布日期2026-05-28docs.cloud.google.com ↗已核实
退役日期不早于 2027-05-28docs.cloud.google.com ↗已核实
上下文窗口65,536 tokendocs.cloud.google.com ↗已核实
最大输出 token32,768 tokendocs.cloud.google.com ↗已核实
模态文本和图像输入/输出;不支持音频和视频docs.cloud.google.com ↗已核实
最大输入图像数每个提示 14 张图像docs.cloud.google.com ↗已核实
输出分辨率1K、2K、4K(4K 为预览)docs.cloud.google.com ↗已核实
支持宽高比1:1、3:2、2:3、3:4、4:3、4:5、5:4、9:16、16:9、21:9docs.cloud.google.com ↗已核实
支持图像 MIME 类型image/png、image/jpeg、image/webp、image/heic、image/heifdocs.cloud.google.com ↗已核实
输入大小限制500 MBdocs.cloud.google.com ↗已核实
输入图像计费 token每张输入图像 560 个输入图像 tokendocs.cloud.google.com ↗已核实
图像输出计费 token1K/2K 图像为 1,120 个输出 token;4K 图像为 2,000 个输出 tokencloud.google.com ↗已核实
Google 标准标价$2/M 输入 token;$12/M 文本输出 token;$120/M 图像输出 tokencloud.google.com ↗已核实
能力Thinking、系统指令、图像生成/编辑、图文交错、C2PA、Count Tokens、Google 搜索 groundingdocs.cloud.google.com ↗已核实
不支持能力Gemini Live API、结构化输出、上下文缓存、RAG Engine、原生 chat completions、微调、URL context、代码执行、函数调用docs.cloud.google.com ↗已核实
许可专有(Google)已核实

基准成绩

BenchmarkDistributionScoreSource
Google model card — complex image generation and editing
Google 公开规格称 Gemini 3 Pro Image 是最适合复杂和多轮图像生成/编辑的模型,准确性和图像质量都有提升,但模型页没有发布数值基准表。
Best Gemini image model for complex and multi-turn image generation/editing; numeric benchmark not publicly discloseddocs.cloud.google.com ↗
Output-resolution support
分辨率支持是路由时非常实际的能力基准:GA 端点支持 1K 和 2K,4K 仍为预览能力,应搭配重试/回退逻辑。
1K, 2K, 4K previewdocs.cloud.google.com ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

建议使用异步 API

图像生成通常需要 30–180 秒,超过同步请求的边缘超时。下方示例已使用 ?async=true + 轮询模式。 查看异步图像生成 / 编辑完整指南 →

cURL
# 1) Submit job (returns 202 immediately with a polling URL).
# Image generation takes 30-180s — always use the async path in production.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/generations?async=true"   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "google/gemini-3-pro-image",
    "prompt": "A cinematic product render with soft studio lighting"
  }' | python3 -c "import sys,json;print(json.load(sys.stdin)['id'])")
echo "submitted: $JOB"

# 2) Poll until terminal (succeeded / failed / cancelled / expired).
while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THE_ROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['status'])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['unsigned_urls'][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

API 使用指南

完整 API 参考 →

异步图像生成

通过 TheRouter 的 OpenAI 兼容 Images API 提交图像生成任务。生产环境建议使用异步路径,避免长时间渲染触发请求超时。

cURL
# 1) Submit an async generation job.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/generations?async=true"   -H "Authorization: Bearer $THEROUTER_API_KEY"   -H "Content-Type: application/json"   -d '{
    "model": "google/gemini-3-pro-image",
    "prompt": "Create a clean 16:9 product hero image for an AI routing dashboard, dark background, teal highlights, crisp UI typography.",
    "size": "1792x1024",
    "n": 1
  }' | python3 -c "import sys,json;print(json.load(sys.stdin)["id"])")

# 2) Poll the job until it succeeds or fails.
while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THEROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)["status"])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)["unsigned_urls"][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

图像编辑示例

上传一张图片并用文本 prompt 描述编辑要求;模型会返回编辑后的图片(base64)。

cURL
# Same async submit + poll pattern as /v1/images/generations.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/edits?async=true"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -F "model=google/gemini-3-pro-image"   -F "prompt=Turn this scene into a watercolor painting"   -F "size=1024x1024"   -F "image=@input.png" | python3 -c "import sys,json;print(json.load(sys.stdin)['id'])")
echo "submitted: $JOB"

while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THE_ROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['status'])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['unsigned_urls'][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

google 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2026-05-28

Gemini 3 Pro Image 以 Nano Banana Pro 品牌 GA

Google Agent Platform 模型页将 Gemini 3 Pro Image 列为 GA 端点,发布日期为 2026-05-28,支持 global 可用性、reasoning、图像生成/编辑、C2PA 内容凭证、批量推理,并承诺至少支持到 2027-05-28。

TheRouter 编辑重写docs.cloud.google.com ↗
2026-05-28

Google 公布 Gemini 3 Pro Image token 定价

Google Cloud 定价页显示 Gemini 3 Pro Image 标准端点为 $2/M 输入 token、$12/M 文本输出 token、$120/M 图像输出 token;1K/2K 图像按 1,120 输出 token 计费,4K 按 2,000 输出 token 计费。

TheRouter 编辑重写cloud.google.com ↗

常见问题

Gemini 3 Pro Image 可以通过 TheRouter 的 OpenAI 兼容 API 调用吗?

可以。使用 TheRouter 的 OpenAI 兼容图像端点,并设置 model: "google/gemini-3-pro-image"。生产环境建议使用 POST /v1/images/generations?async=true 或 /v1/images/edits?async=true,再轮询返回的任务 URL。

TheRouter 编辑重写therouter.ai ↗
Gemini 3 Pro Image 每张图多少钱?

按 Google 标价,图像输出为每 100 万图像输出 token $120。Google 称 1K 和 2K 输出消耗 1,120 token,约 $0.134/张;4K 输出消耗 2,000 token,约 $0.24/张。文本和输入图像 token 另行计费。

TheRouter 编辑重写cloud.google.com ↗
Gemini 3 Pro Image 支持哪些图像输入和输出尺寸?

Google 列出每个提示最多 14 张输入图,支持 PNG/JPEG/WebP/HEIC/HEIF 输入,支持 1:1、16:9、9:16、21:9 等宽高比,输出分辨率为 1K、2K 和 4K。4K 输出仍标记为 Preview。

TheRouter 编辑重写docs.cloud.google.com ↗
Gemini 3 Pro Image 支持函数调用或结构化 JSON 输出吗?

不支持。Google 公开模型规格将函数调用和结构化输出标为不支持。工具调用 agent、JSON 抽取和 schema 约束生成应改路由到 Gemini 3.5 Flash、Gemini 2.5 Pro 或其他 chat 模型。

TheRouter 编辑重写docs.cloud.google.com ↗
应该用 Gemini 3 Pro Image 还是 GPT Image 2?

当你需要 Google 搜索 grounding、C2PA 凭证、Google Cloud 治理、多参考图,或希望保持 Gemini 家族路由一致性时,选 Gemini 3 Pro Image。当团队更重视 OpenAI 原生图像 API 行为,或提示词体系已经围绕 OpenAI 图像模型标准化时,选 GPT Image 2。无论选哪个,大规模迁移前都应先跑一小组品牌专属评测。

TheRouter 编辑重写docs.cloud.google.com ↗
事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布阶段docs.cloud.google.com ↗2026-07-25已核实
发布日期docs.cloud.google.com ↗2026-07-25已核实
退役日期docs.cloud.google.com ↗2026-07-25已核实
上下文窗口docs.cloud.google.com ↗2026-07-25已核实
最大输出 tokendocs.cloud.google.com ↗2026-07-25已核实
模态docs.cloud.google.com ↗2026-07-25已核实
最大输入图像数docs.cloud.google.com ↗2026-07-25已核实
输出分辨率docs.cloud.google.com ↗2026-07-25已核实
支持宽高比docs.cloud.google.com ↗2026-07-25已核实
支持图像 MIME 类型docs.cloud.google.com ↗2026-07-25已核实
输入大小限制docs.cloud.google.com ↗2026-07-25已核实
输入图像计费 tokendocs.cloud.google.com ↗2026-07-25已核实
图像输出计费 tokencloud.google.com ↗2026-07-25已核实
Google 标准标价cloud.google.com ↗2026-07-25已核实
能力docs.cloud.google.com ↗2026-07-25已核实
不支持能力docs.cloud.google.com ↗2026-07-25已核实
许可——已核实
Google model card — complex image generation and editingdocs.cloud.google.com ↗2026-07-25已核实
Output-resolution supportdocs.cloud.google.com ↗2026-07-25已核实
Gemini 3 Pro Image 以 Nano Banana Pro 品牌 GAdocs.cloud.google.com ↗2026-07-25已核实
Google 公布 Gemini 3 Pro Image token 定价cloud.google.com ↗2026-07-25已核实
Gemini 3 Pro Image 可以通过 TheRouter 的 OpenAI 兼容 API 调用吗?therouter.ai ↗2026-07-25待核实
Gemini 3 Pro Image 每张图多少钱?cloud.google.com ↗2026-07-25待核实
Gemini 3 Pro Image 支持哪些图像输入和输出尺寸?docs.cloud.google.com ↗2026-07-25待核实
Gemini 3 Pro Image 支持函数调用或结构化 JSON 输出吗?docs.cloud.google.com ↗2026-07-25待核实
应该用 Gemini 3 Pro Image 还是 GPT Image 2?docs.cloud.google.com ↗2026-07-25待核实
帮助与联系