Назад к моделям

Gemini 3 Pro Image

googlegoogle/gemini-3-pro-image

Google's GA image generation model built on Gemini 3 Pro. Premium multimodal image-gen model with creative and design capabilities. Replaces gemini-3-pro-image-preview.

Gemini 3 Pro Image, также известная как Nano Banana Pro, — GA-модель Google для reasoning-driven генерации и редактирования изображений в профессиональных визуальных задачах. Google позиционирует её как самую сильную модель Gemini для сложной и многоходовой генерации, редактирования изображений, чередующегося текста и изображений, а также запросов, где модель должна осмыслить макет перед рендерингом.

С эксплуатационной точки зрения это модель с вводом и выводом текста и изображений: окно контекста 65 536 токенов, максимум 32 768 выходных токенов, до 14 входных изображений на запрос, вывод 1K/2K и preview-вывод 4K, Content Credentials C2PA, grounding через Google Search, batch inference и поддержка Provisioned Throughput. Модель не поддерживает аудио, видео, Gemini Live API, function calling, structured output, tuning и OpenAI chat completions на нативной стороне Google.

Через TheRouter Gemini 3 Pro Image следует рассматривать как премиальную асинхронную image-модель: вызывайте OpenAI-compatible Images API с model: "google/gemini-3-pro-image", отправляйте запрос с ?async=true, затем опрашивайте возвращённую задачу. Стандартные цены Google: $2/М входных токенов, $12/М текстовых выходных токенов и $120/М image output tokens; изображения 1K и 2K потребляют 1 120 image output tokens, а 4K — 2 000.

Когда выбирать
  • • Профессиональная генерация изображений, где важны рассуждения по запросу: постеры, hero-art кампаний, продуктовые визуалы, технические схемы и концепты со множеством ограничений
  • • Многоходовое редактирование изображений — итеративные дизайн-ревью, где исходное изображение уточняется несколькими инструкциями, а не пересоздаётся с нуля
  • • Креативные процессы с большим числом референсов — до 14 входных изображений на запрос для стиля, продукта, персонажа или макета
  • • Enterprise image pipelines, которым нужны C2PA credentials, глобальный регион, batch inference и Provisioned Throughput, а не любительские интерактивные инструменты
Когда не выбирать
  • • Дешёвая черновая генерация — image output стоит $120/М токенов ($0.134 за 1K/2K и $0.24 за 4K по прайсу Google); для массовой генерации идей используйте Gemini 3.1 Flash Image или более дешёвую image-модель
  • • Realtime или синхронные пользовательские сценарии — image-задачи могут превышать лимиты edge-запросов, поэтому production-интеграции должны использовать async submit-and-poll TheRouter
  • • Tool-calling агенты, JSON extraction, embeddings, аудио или видео — модель специализируется на text/image generation и editing, а не на общих chat-agent API
Размер контекста
66K
Максимальный вывод
33K
Цена Входза 1M токенов
$2.19за 1 млн токенов
Цена Выходза 1M токенов
$131.65за 1 млн токенов

Модальности

ТекстИзображение→ТекстИзображение

Возможности

ЗрениеГенерация изображений

Разбивка цен

ТипСтавка
Вход$2.19 за 1 млн токенов
Выход$131.65 за 1 млн токенов

Single blended output rate = the image-output rate ($120/MTok). Google also publishes a separate text/thinking output rate of $12/MTok that this schema cannot express, so non-image output tokens are over-billed. Source: ai.google.dev/gemini-api/docs/pricing, read 2026-07-29.

Поддерживаемые параметры

temperaturemax_tokenstop_presponse_formatstop

Характеристики

Стадия запускаGAdocs.cloud.google.com ↗проверено
Дата релиза2026-05-28docs.cloud.google.com ↗проверено
Дата вывода из эксплуатации28.05.2027 или позжеdocs.cloud.google.com ↗проверено
Окно контекста65 536 токеновdocs.cloud.google.com ↗проверено
Максимум выходных токенов32 768 токеновdocs.cloud.google.com ↗проверено
МодальностиВвод/вывод текста и изображений; аудио и видео не поддерживаютсяdocs.cloud.google.com ↗проверено
Максимум входных изображений14 изображений на запросdocs.cloud.google.com ↗проверено
Разрешения вывода1K, 2K, 4K (4K в Preview)docs.cloud.google.com ↗проверено
Поддерживаемые соотношения сторон1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9docs.cloud.google.com ↗проверено
Поддерживаемые MIME-типы изображенийimage/png, image/jpeg, image/webp, image/heic, image/heifdocs.cloud.google.com ↗проверено
Лимит размера ввода500 MBdocs.cloud.google.com ↗проверено
Учёт входных изображений560 input image tokens на входное изображениеdocs.cloud.google.com ↗проверено
Учёт выходных изображений1 120 output tokens для изображений 1K/2K; 2 000 output tokens для 4Kcloud.google.com ↗проверено
Стандартный прайс Google$2/М входных токенов; $12/М текстовых выходных токенов; $120/М image output tokenscloud.google.com ↗проверено
ВозможностиThinking, system instructions, image generation/editing, interleaved images and text, C2PA, Count Tokens, Google Search groundingdocs.cloud.google.com ↗проверено
Неподдерживаемые возможностиGemini Live API, structured output, context caching, RAG Engine, native chat completions, tuning, URL context, code execution, function callingdocs.cloud.google.com ↗проверено
ЛицензияПроприетарная (Google)проверено

Бенчмарки

BenchmarkDistributionScoreSource
Google model card — complex image generation and editing
Публичная спецификация Google описывает Gemini 3 Pro Image как лучшую модель для сложной и многоходовой генерации/редактирования изображений, с повышенной точностью и качеством, но численная таблица benchmark на странице модели не опубликована.
Best Gemini image model for complex and multi-turn image generation/editing; numeric benchmark not publicly discloseddocs.cloud.google.com ↗
Output-resolution support
Поддержка разрешений — practically useful routing benchmark: 1K и 2K поддерживаются на GA endpoint, а 4K остаётся preview и должна использоваться с retry/fallback logic.
1K, 2K, 4K previewdocs.cloud.google.com ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

Рекомендуется асинхронный API

Генерация изображений обычно занимает 30–180 секунд и не укладывается в edge timeout синхронного запроса. Ниже используется схема ?async=true + polling. Открыть полный гид по асинхронной генерации и редактированию изображений →

cURL
# 1) Submit job (returns 202 immediately with a polling URL).
# Image generation takes 30-180s — always use the async path in production.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/generations?async=true"   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "google/gemini-3-pro-image",
    "prompt": "A cinematic product render with soft studio lighting"
  }' | python3 -c "import sys,json;print(json.load(sys.stdin)['id'])")
echo "submitted: $JOB"

# 2) Poll until terminal (succeeded / failed / cancelled / expired).
while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THE_ROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['status'])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['unsigned_urls'][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

Асинхронная генерация изображений

Отправляйте image-generation jobs через OpenAI-compatible Images API TheRouter. Для production используйте async path, чтобы долгий рендер не упёрся в таймаут запроса.

cURL
# 1) Submit an async generation job.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/generations?async=true"   -H "Authorization: Bearer $THEROUTER_API_KEY"   -H "Content-Type: application/json"   -d '{
    "model": "google/gemini-3-pro-image",
    "prompt": "Create a clean 16:9 product hero image for an AI routing dashboard, dark background, teal highlights, crisp UI typography.",
    "size": "1792x1024",
    "n": 1
  }' | python3 -c "import sys,json;print(json.load(sys.stdin)["id"])")

# 2) Poll the job until it succeeds or fails.
while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THEROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)["status"])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)["unsigned_urls"][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

Примеры редактирования изображений

Загрузите изображение и опишите нужное изменение текстовым prompt; модель вернёт отредактированную картинку в base64.

cURL
# Same async submit + poll pattern as /v1/images/generations.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/edits?async=true"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -F "model=google/gemini-3-pro-image"   -F "prompt=Turn this scene into a watercolor painting"   -F "size=1024x1024"   -F "image=@input.png" | python3 -c "import sys,json;print(json.load(sys.stdin)['id'])")
echo "submitted: $JOB"

while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THE_ROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['status'])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['unsigned_urls'][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

Ещё от google

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2026-05-28

Gemini 3 Pro Image выходит в GA как Nano Banana Pro

Страница модели Google Agent Platform указывает Gemini 3 Pro Image как GA endpoint с датой релиза 28.05.2026, глобальной доступностью, reasoning support, image generation/editing, C2PA credentials, batch inference и минимальной поддержкой до 28.05.2027.

переработано TheRouterdocs.cloud.google.com ↗
2026-05-28

Google публикует token pricing для Gemini 3 Pro Image

Google Cloud pricing указывает стандартный endpoint Gemini 3 Pro Image по $2/М input tokens, $12/М text output tokens и $120/М image output tokens; изображения 1K/2K тарифицируются как 1 120 output tokens, 4K — как 2 000.

переработано TheRoutercloud.google.com ↗

Частые вопросы

Доступна ли Gemini 3 Pro Image через OpenAI-compatible API в TheRouter?

Да. Используйте OpenAI-compatible image endpoints TheRouter с model: "google/gemini-3-pro-image". Для production предпочтительны POST /v1/images/generations?async=true или /v1/images/edits?async=true, затем polling возвращённого job URL.

переработано TheRoutertherouter.ai ↗
Сколько стоит изображение в Gemini 3 Pro Image?

По прайсу Google image output стоит $120 за 1M image output tokens. Google указывает, что 1K и 2K output потребляют 1 120 токенов, то есть около $0.134 за изображение, а 4K — 2 000 токенов, около $0.24. Text и input-image tokens оплачиваются отдельно.

переработано TheRoutercloud.google.com ↗
Какие входные изображения и размеры вывода поддерживает Gemini 3 Pro Image?

Google указывает до 14 входных изображений на запрос, входы PNG/JPEG/WebP/HEIC/HEIF, соотношения сторон включая 1:1, 16:9, 9:16 и 21:9, а также output resolutions 1K, 2K и 4K. Вывод 4K всё ещё помечен как Preview.

переработано TheRouterdocs.cloud.google.com ↗
Поддерживает ли Gemini 3 Pro Image function calling или structured JSON output?

Нет. В публичной спецификации Google function calling и structured output отмечены как unsupported. Tool-calling agents, JSON extraction и schema-constrained generation лучше маршрутизировать на Gemini 3.5 Flash, Gemini 2.5 Pro или другую chat-модель.

переработано TheRouterdocs.cloud.google.com ↗
Что выбрать: Gemini 3 Pro Image или GPT Image 2?

Выбирайте Gemini 3 Pro Image, когда важны Google Search grounding, C2PA credentials, governance Google Cloud, много reference images или единообразная Gemini-family routing. Выбирайте GPT Image 2, если команде нужно максимально OpenAI-native image API behavior или prompts уже стандартизованы вокруг OpenAI image models. В любом случае перед bulk generation прогоните небольшой brand-specific eval set.

переработано TheRouterdocs.cloud.google.com ↗
Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Стадия запускаdocs.cloud.google.com ↗2026-07-25проверено
Дата релизаdocs.cloud.google.com ↗2026-07-25проверено
Дата вывода из эксплуатацииdocs.cloud.google.com ↗2026-07-25проверено
Окно контекстаdocs.cloud.google.com ↗2026-07-25проверено
Максимум выходных токеновdocs.cloud.google.com ↗2026-07-25проверено
Модальностиdocs.cloud.google.com ↗2026-07-25проверено
Максимум входных изображенийdocs.cloud.google.com ↗2026-07-25проверено
Разрешения выводаdocs.cloud.google.com ↗2026-07-25проверено
Поддерживаемые соотношения сторонdocs.cloud.google.com ↗2026-07-25проверено
Поддерживаемые MIME-типы изображенийdocs.cloud.google.com ↗2026-07-25проверено
Лимит размера вводаdocs.cloud.google.com ↗2026-07-25проверено
Учёт входных изображенийdocs.cloud.google.com ↗2026-07-25проверено
Учёт выходных изображенийcloud.google.com ↗2026-07-25проверено
Стандартный прайс Googlecloud.google.com ↗2026-07-25проверено
Возможностиdocs.cloud.google.com ↗2026-07-25проверено
Неподдерживаемые возможностиdocs.cloud.google.com ↗2026-07-25проверено
Лицензия——проверено
Google model card — complex image generation and editingdocs.cloud.google.com ↗2026-07-25проверено
Output-resolution supportdocs.cloud.google.com ↗2026-07-25проверено
Gemini 3 Pro Image выходит в GA как Nano Banana Prodocs.cloud.google.com ↗2026-07-25проверено
Google публикует token pricing для Gemini 3 Pro Imagecloud.google.com ↗2026-07-25проверено
Доступна ли Gemini 3 Pro Image через OpenAI-compatible API в TheRouter?therouter.ai ↗2026-07-25к проверке
Сколько стоит изображение в Gemini 3 Pro Image?cloud.google.com ↗2026-07-25к проверке
Какие входные изображения и размеры вывода поддерживает Gemini 3 Pro Image?docs.cloud.google.com ↗2026-07-25к проверке
Поддерживает ли Gemini 3 Pro Image function calling или structured JSON output?docs.cloud.google.com ↗2026-07-25к проверке
Что выбрать: Gemini 3 Pro Image или GPT Image 2?docs.cloud.google.com ↗2026-07-25к проверке
Помощь и контакты