Назад к моделям

GPT Image 2

openaiopenai/gpt-image-2

OpenAI's most advanced image generation model with native reasoning — thinks before drawing. 2K resolution, multi-image consistency, magazine-quality typography, and image editing. Released April 21, 2026.

GPT Image 2 (gpt-image-2), запущенная 21 апреля 2026 года под брендом «ChatGPT Images 2.0», является самой мощной моделью генерации изображений OpenAI. Это первая модель OpenAI, интегрирующая возможности рассуждения O-серии — планирование композиции, поиск в интернете для референсов и самопроверку результатов до рендеринга. Модель представляет собой качественный скачок от диффузионных пайплайнов DALL·E 3 и gpt-image-1: она сначала анализирует задачу, а затем генерирует, что делает её агентной моделью, а не простым декодером текст-в-изображение.

Модель обеспечивает нативный вывод в разрешении 2048×2048 (2К), лучшее в своём классе многоязычное отображение текста на CJK, кириллице, арабском, хинди и бенгали, до 8 согласованных изображений на один запрос с общими персонажами и освещением, поддержку прозрачного фона и генерацию функциональных QR-кодов. На Image Arena GPT Image 2 заняла #1 во всех категориях при запуске с отрывом в +242 балла в Text-to-Image — самый большой отрыв за всю историю платформы. Через TheRouter модель доступна через стандартный OpenAI-совместимый эндпоинт /v1/images/generations, что делает её бесшовным обновлением с gpt-image-1.5 или DALL·E 3.

Когда выбирать
  • • Маркетинговые материалы с обилием текста — плакаты, инфографика, реклама и UI-макеты, где текст внутри изображения должен быть чётким, точным и корректно отображаться на CJK, кириллице, арабском или смешанных шрифтах
  • • Сложные макеты с режимом рассуждения — многостраничная инфографика, панели манги, раскадровки, научные диаграммы и редакционные макеты, где предварительное рассуждение обеспечивает точность композиции
  • • Согласованные многоизображенческие активы — до 8 изображений на запрос с общими персонажами, освещением, палитрой и стилем, идеально для креативных наборов кампаний и вариантов продукта
  • • Локализованное креативное производство — постеры, реклама и упаковка на местных языках для международных рынков с точностью на уровне символов в нелатинских шрифтах, ранее недоступной в AI-генерации изображений
  • • Генерация функциональных QR-кодов — коды, которые реально сканируются, стилизованные под бренд и встроенные в дизайн постеров, объединяя три инструмента в один вызов API
Когда не выбирать
  • • Сверхвысокообъёмная пакетная генерация на низкоуровневых аккаунтах — Tier 1 ограничивает 5 изображений/минуту; достижение Tier 3 (50/мин) требует $100 расходов и аккаунт старше 7 дней. Для черновиков используйте gpt-image-1-mini (~на 75% дешевле)
  • • Конвейеры реального времени, чувствительные к задержкам — режим рассуждения может занимать до 2 минут для сложных запросов; мгновенный режим быстрее, но всё ещё не поддерживает потоковый вывод
  • • Открытое или офлайн-развёртывание — gpt-image-2 проприетарна и доступна только через API; саморазвёртывание и тонкая настройка недоступны при запуске
  • • Высокостилизованная живописная/иллюстративная работа — Midjourney V8 сохраняет преимущество в редакционных иллюстрациях, обложках книг и художественной эстетике, где настроение важнее точности

Чем обслуживание в TheRouter отличается от вендорского

Как её эксплуатирует вендор

OpenAI обслуживает прямые вызовы gpt-image-2 через /v1/images/generations и /v1/images/edits; страница модели отмечает, что /v1/responses и /v1/chat/completions для самого ID модели не поддерживаются.

На TheRouter

TheRouter предоставляет те же поверхности генерации и редактирования изображений на https://api.therouter.ai/v1 с маршрутизируемым ID модели openai/gpt-image-2. Поэтому примеры сохраняют форму OpenAI SDK, но меняют baseURL, API key и slug модели.

Размер контекста
--
Максимальный вывод
--
Цена Изображениеза 1M токенов
$0.0572за изображение
Цена Входза 1M токенов
$5.40за 1 млн токенов

Модальности

ТекстИзображение→Изображение

Возможности

ЗрениеГенерация изображенийРедактирование изображений

Возможности генерации медиа

image_generation
sizes
  • 1024x1024
  • 1024x1536
  • 1536x1024
qualities
  • low
  • medium
  • high
max_outputs_per_request
4
output_formats
  • png
  • jpeg
  • webp
defaults
size
1024x1024
quality
medium
image_edit
sizes
  • 1024x1024
  • 1024x1536
  • 1536x1024
qualities
  • low
  • medium
  • high
max_reference_images
4
output_formats
  • png
  • jpeg
  • webp
defaults
size
1024x1024
quality
medium

Разбивка цен

ТипСтавка
Изображение$0.0572 за изображение
Вход$5.40 за 1 млн токенов
Выход$32.40 за 1 млн токенов
Image input$8.64 за 1 млн токенов
Cached image input$2.16 за 1 млн токенов
Low quality$0.0065 за изображение
Medium quality$0.0572 за изображение
High quality$0.2279 за изображение

image is medium-quality generation price; high-quality bills at image_qualities.high

Поддерживаемые параметры

promptsizequalitybackgroundoutput_formatnuser

Характеристики

Дата релиза2026-04-21openai.com ↗проверено
Максимальное разрешениеДо 3840px по длинной стороне; популярные 4K-размеры включают 3840×2160 и 2160×3840developers.openai.com ↗проверено
Соотношения сторонПроизвольные размеры, где отношение длинной стороны к короткой не превышает 3:1; обе стороны должны быть кратны 16pxdevelopers.openai.com ↗проверено
Форматы выводаPNG по умолчанию; также поддерживаются JPEG и WebP. Прозрачный фон для gpt-image-2 не поддерживается.developers.openai.com ↗проверено
Дата отсечения знанийНе раскрытоdevelopers.openai.com ↗неизвестно
Режим размышленияОпциональный проход рассуждения перед генерацией — веб-поиск, планирование композиции, самопроверка (по умолчанию выключен в API)openai.com ↗проверено
Изображений на запросНесколько изображений в одном запросе через параметр n; точный максимум в руководстве модели не раскрытdevelopers.openai.com ↗неизвестно
ЛицензияПроприетарная (условия OpenAI API — обучение на данных клиентов не производится)проверено

Бенчмарки

BenchmarkDistributionScoreSource
Image Arena — Text-to-Image (overall)
#1 — опережает Nano-banana-2 на 242 балла, самый большой отрыв в истории Arena
1512arena.ai ↗
Image Arena — Single-Image Edit
#1 — опережает Nano-banana-pro на 125 баллов
1513arena.ai ↗
Image Arena — Multi-Image Edit
#1 — опережает Nano-banana-2 на 90 баллов
1464arena.ai ↗
Image Arena — Text Rendering sub-category
Наибольшее улучшение по сравнению с gpt-image-1.5 — скачок на +316 баллов в качестве рендеринга текста
+316arena.ai ↗
Image Arena — Product, Branding & Commercial Design
+277 по сравнению с gpt-image-1.5
+277arena.ai ↗
Image Arena — Portraits sub-category
+296 по сравнению с gpt-image-1.5
+296arena.ai ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

Рекомендуется асинхронный API

Генерация изображений обычно занимает 30–180 секунд и не укладывается в edge timeout синхронного запроса. Ниже используется схема ?async=true + polling. Открыть полный гид по асинхронной генерации и редактированию изображений →

cURL
# 1) Submit job (returns 202 immediately with a polling URL).
# Image generation takes 30-180s — always use the async path in production.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/generations?async=true"   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "openai/gpt-image-2",
    "prompt": "A cinematic product render with soft studio lighting"
  }' | python3 -c "import sys,json;print(json.load(sys.stdin)['id'])")
echo "submitted: $JOB"

# 2) Poll until terminal (succeeded / failed / cancelled / expired).
while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THE_ROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['status'])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['unsigned_urls'][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

Генерация изображений

Создавайте изображения по текстовым запросам через стандартный OpenAI Images API. Поддерживается разрешение 2K, уровни качества, выбор формата вывода, прозрачный фон и до 8 изображений за один запрос.

cURL
curl https://api.therouter.ai/v1/images/generations \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-image-2",
    "prompt": "A serene mountain landscape at sunset, photorealistic style",
    "n": 1,
    "size": "2048x2048",
    "quality": "medium",
    "output_format": "png"
  }'

Примеры редактирования изображений

Загрузите изображение и опишите нужное изменение текстовым prompt; модель вернёт отредактированную картинку в base64.

cURL
# Same async submit + poll pattern as /v1/images/generations.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/edits?async=true"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -F "model=openai/gpt-image-2"   -F "prompt=Turn this scene into a watercolor painting"   -F "size=1024x1024"   -F "image=@input.png" | python3 -c "import sys,json;print(json.load(sys.stdin)['id'])")
echo "submitted: $JOB"

while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THE_ROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['status'])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['unsigned_urls'][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

Ещё от openai

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2026-04-21

OpenAI запускает ChatGPT Images 2.0 с gpt-image-2 — генерация изображений на основе рассуждений

OpenAI представила gpt-image-2 — самую мощную модель генерации изображений с нативным разрешением 2K, возможностями рассуждения O-серии, лучшим в классе многоязычным рендерингом текста на CJK, арабском, хинди и бенгали, до 8 согласованных изображений на запрос, интеграцией веб-поиска и генерацией функциональных QR-кодов. Модель заняла #1 во всех категориях Image Arena в день запуска с рекордными отрывами. DALL·E 2 и DALL·E 3 планируется вывести из эксплуатации 12 мая 2026 года.

переработано TheRouteropenai.com ↗

Свежие материалы

Частые вопросы

Чем gpt-image-2 отличается от gpt-image-1.5?

gpt-image-2 — это крупное архитектурное обновление: первая модель OpenAI с возможностями рассуждения O-серии. Она представляет режим размышления (модель планирует композицию, ищет в интернете и самопроверяет перед генерацией), нативное разрешение 2K (2048×2048), почти идеальный многоязычный рендеринг текста на CJK, арабском, хинди, бенгали и кириллице, до 8 согласованных изображений на запрос, интеграцию веб-поиска и генерацию функциональных QR-кодов. В бенчмарках она опередила следующую лучшую модель на +242 балла в Image Arena Text-to-Image. DALL·E 3 будет выведена из эксплуатации 12 мая 2026 года.

Какие разрешения и соотношения сторон поддерживает gpt-image-2?

gpt-image-2 поддерживает нативный вывод с разрешением до 2048×2048 (2K) и непрерывный диапазон соотношений сторон от 3:1 (широкий баннер) до 1:3 (высокий вертикальный). Это устраняет необходимость кадрирования или масштабирования после генерации. Предыдущее поколение было ограничено фиксированными пресетами 1:1, 2:3 и 3:2. Меньшие разрешения можно указать для более быстрой генерации и снижения затрат.

переработано TheRouterfelloai.com ↗
Совместим ли gpt-image-2 с моей существующей интеграцией DALL·E 3?

Да — миграция в основном состоит из замены model ID. API использует те же эндпоинты /v1/images/generations и /v1/images/edits. Измените параметр модели с "dall-e-3" на "openai/gpt-image-2" (или "gpt-image-2" при прямом вызове OpenAI). DALL·E 2 и DALL·E 3 официально выводятся из эксплуатации 12 мая 2026 года, поэтому миграция обязательна. Пользователи TheRouter просто обновляют slug модели в своём API-вызове.

переработано TheRoutergptimage2.design ↗
Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релизаopenai.com ↗2026-05-29проверено
Максимальное разрешениеdevelopers.openai.com ↗2026-08-04проверено
Соотношения сторонdevelopers.openai.com ↗2026-08-04проверено
Форматы выводаdevelopers.openai.com ↗2026-08-04проверено
Дата отсечения знанийdevelopers.openai.com ↗2026-08-04неизвестно
Режим размышленияopenai.com ↗2026-05-29проверено
Изображений на запросdevelopers.openai.com ↗2026-08-04неизвестно
Лицензия——проверено
Image Arena — Text-to-Image (overall)arena.ai ↗2026-08-04проверено
Image Arena — Single-Image Editarena.ai ↗2026-08-04проверено
Image Arena — Multi-Image Editarena.ai ↗2026-08-04проверено
Image Arena — Text Rendering sub-categoryarena.ai ↗2026-08-04проверено
Image Arena — Product, Branding & Commercial Designarena.ai ↗2026-08-04проверено
Image Arena — Portraits sub-categoryarena.ai ↗2026-08-04проверено
OpenAI запускает ChatGPT Images 2.0 с gpt-image-2 — генерация изображений на основе рассужденийopenai.com ↗2026-05-29проверено
Чем gpt-image-2 отличается от gpt-image-1.5?openai.com ↗2026-05-29к проверке
Какие разрешения и соотношения сторон поддерживает gpt-image-2?felloai.com ↗2026-05-29к проверке
Совместим ли gpt-image-2 с моей существующей интеграцией DALL·E 3?gptimage2.design ↗2026-05-29к проверке
Помощь и контакты