Назад к моделям

GPT Image 1

openaiopenai/gpt-image-1

Previous generation image generation model.

GPT Image 1 (gpt-image-1) — первая нативно мультимодальная модель генерации изображений от OpenAI, построенная на декодере класса GPT-4 со специализированными встраиваниями визуальных токенов и кросс-модальным вниманием. Выпущенная в апреле 2025 года, эта модель обеспечила работу функции генерации изображений в ChatGPT — за первую неделю более 130 миллионов пользователей создали свыше 700 миллионов изображений. В отличие от диффузионных подходов (DALL·E 3), gpt-image-1 использует авторегрессионный декодер, трактующий изображения как токены, что даёт ему понимание реального мира и способность выполнять сложные инструкции по дизайну.

Через TheRouter gpt-image-1 доступен через стандартный OpenAI-совместимый эндпоинт Images API по адресу api.therouter.ai/v1/images/generations. Модель поддерживает генерацию из текста, редактирование по изображению, инпейнтинг с масками и вывод с прозрачным фоном. Она оптимальна для продакшн-пайплайнов, требующих надёжной высококачественной генерации визуального контента, а не для экспериментальных или открытых рабочих процессов.

Когда выбирать
  • • Генерация из текста — создание высококачественных изображений по текстовым запросам в фотореалистичном, иллюстративном, аниме, векторном, 3D стилях и визуализации данных
  • • Точное отображение текста внутри изображений — плакаты, UI-макеты, многострочные надписи и мелкий шрифт, который действительно читается
  • • Редактирование изображений и инпейнтинг — изменение существующих изображений по текстовым запросам, применение масок для точечных правок или смена стиля
  • • Продакшн-креативы — реклама в соцсетях, геройские изображения, рендеры товаров для e-commerce и маркетинговые материалы в едином бренд-стиле
  • • Корпоративная безопасность — встроенные C2PA-водяные знаки, настраиваемая модерация и отсутствие обучения на данных клиентов
Когда не выбирать
  • • Сверхбыстрые черновики — DALL·E 3 быстрее для простых набросков 512px, когда качество не критично
  • • Полностью открытое или офлайн-развёртывание — в отличие от Stable Diffusion, gpt-image-1 проприетарен и доступен только через API
  • • Экспериментальный поиск стилей — Midjourney v7 предлагает более широкий набор сообщественных художественных стилей
  • • Генерация в реальном времени — модель требует полной обработки запроса перед выдачей результата; инкрементальный вывод не поддерживается

Чем обслуживание в TheRouter отличается от вендорского

Как её эксплуатирует вендор

OpenAI обслуживает прямые вызовы gpt-image-1 через /v1/images/generations и /v1/images/edits, а страница модели также указывает поддержку /v1/responses для этого ID модели.

На TheRouter

TheRouter предоставляет генерацию и редактирование изображений для openai/gpt-image-1 на https://api.therouter.ai/v1. Используйте форму OpenAI SDK с baseURL TheRouter, API key и маршрутизируемым slug модели; не предполагайте, что chat/completions работает для этой модели изображений.

Размер контекста
--
Максимальный вывод
--
Цена Изображениеза 1M токенов
$0.0454за изображение
Цена Входза 1M токенов
$5.40за 1 млн токенов

Модальности

ТекстИзображение→Изображение

Возможности

ЗрениеГенерация изображенийРедактирование изображений

Возможности генерации медиа

image_generation
sizes
  • 1024x1024
  • 1024x1536
  • 1536x1024
qualities
  • low
  • medium
  • high
max_outputs_per_request
4
output_formats
  • png
  • jpeg
  • webp
defaults
size
1024x1024
quality
medium
image_edit
sizes
  • 1024x1024
  • 1024x1536
  • 1536x1024
qualities
  • low
  • medium
  • high
max_reference_images
4
output_formats
  • png
  • jpeg
  • webp
defaults
size
1024x1024
quality
medium

Разбивка цен

ТипСтавка
Изображение$0.0454 за изображение
Вход$5.40 за 1 млн токенов
Выход$43.20 за 1 млн токенов
Image input$10.80 за 1 млн токенов
Low quality$0.0119 за изображение
Medium quality$0.0454 за изображение
High quality$0.1804 за изображение

image is medium-quality generation price per image

Поддерживаемые параметры

promptsizequalitybackgroundoutput_formatnuser

Характеристики

Дата релиза2025-04-23openai.com ↗проверено
АрхитектураНативно мультимодальная языковая модель для текстовых и графических входов с графическим выводом; более глубокие детали архитектуры не раскрытыdevelopers.openai.com ↗проверено
Нативные разрешения1024×1024, 1024×1536, 1536×1024developers.openai.com ↗проверено
Форматы выводаPNG, JPEG, WebPdevelopers.openai.com ↗проверено
Поддержка фонаПрозрачный, непрозрачный и auto; прозрачный вывод требует PNG или WebPdevelopers.openai.com ↗проверено
Макс. изображений за вызовОт 1 до 10 через параметр ndevelopers.openai.com ↗проверено
Уровни качестваДля моделей GPT Image поддерживаются low, medium, high и autodevelopers.openai.com ↗проверено
ЛицензияПроприетарная (условия OpenAI API)проверено

Бенчмарки

BenchmarkDistributionScoreSource
GIE-Bench
Highest functional-correctness among tested modelsarxiv.org ↗
STRICT text-rendering
Одна из двух проприетарных моделей с низкой частотой ошибок на плотном тексте
—Не раскрыто—

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

Рекомендуется асинхронный API

Генерация изображений обычно занимает 30–180 секунд и не укладывается в edge timeout синхронного запроса. Ниже используется схема ?async=true + polling. Открыть полный гид по асинхронной генерации и редактированию изображений →

cURL
# 1) Submit job (returns 202 immediately with a polling URL).
# Image generation takes 30-180s — always use the async path in production.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/generations?async=true"   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "openai/gpt-image-1",
    "prompt": "A cinematic product render with soft studio lighting"
  }' | python3 -c "import sys,json;print(json.load(sys.stdin)['id'])")
echo "submitted: $JOB"

# 2) Poll until terminal (succeeded / failed / cancelled / expired).
while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THE_ROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['status'])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['unsigned_urls'][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

Генерация изображений

Создавайте изображения по текстовым запросам через стандартный OpenAI Images API. Поддерживаются уровни качества, выбор формата вывода, прозрачный фон и пакетная генерация.

cURL
curl https://api.therouter.ai/v1/images/generations \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-image-1",
    "prompt": "A serene mountain landscape at sunset, photorealistic style",
    "n": 1,
    "size": "1024x1024",
    "quality": "medium",
    "output_format": "png"
  }'

Примеры редактирования изображений

Загрузите изображение и опишите нужное изменение текстовым prompt; модель вернёт отредактированную картинку в base64.

cURL
# Same async submit + poll pattern as /v1/images/generations.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/edits?async=true"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -F "model=openai/gpt-image-1"   -F "prompt=Turn this scene into a watercolor painting"   -F "size=1024x1024"   -F "image=@input.png" | python3 -c "import sys,json;print(json.load(sys.stdin)['id'])")
echo "submitted: $JOB"

while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THE_ROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['status'])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['unsigned_urls'][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

Ещё от openai

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2026-04-21

OpenAI запускает ChatGPT Images 2.0 с gpt-image-2

OpenAI представила gpt-image-2 — модель следующего поколения с выводом в разрешении 2K, улучшенным многоязычным рендерингом текста и агентными возможностями рассуждения. Новая модель развивает основу gpt-image-1, значительно повышая качество и функциональность.

переработано TheRouteropenai.com ↗
2025-12-16

OpenAI выпускает gpt-image-1.5 с 4-кратным ускорением

OpenAI выпустила gpt-image-1.5, преемника gpt-image-1, с примерно 4-кратным ускорением генерации, улучшенным следованием инструкциям, лучшим рендерингом плотного/мелкого текста и более точным редактированием с сохранением логотипов и лиц.

переработано TheRoutertechcrunch.com ↗
2025-04-23

OpenAI запускает gpt-image-1 в API

OpenAI выпустила gpt-image-1 в API, предоставив разработчикам и предприятиям нативную мультимодальную генерацию изображений, которая обеспечила работу вирусной функции изображений в ChatGPT (130 млн+ пользователей, 700 млн+ изображений за первую неделю).

переработано TheRouteropenai.com ↗

Свежие материалы

Частые вопросы

Чем gpt-image-1 отличается от DALL·E 3?

gpt-image-1 — это нативно мультимодальный авторегрессионный трансформер, а не диффузионная модель. Это означает, что он обладает пониманием реального мира благодаря семейству GPT-4o, может следовать очень детальным инструкциям, точнее отображает текст внутри изображений и поддерживает ввод изображений для редактирования. DALL·E 3 использует диффузионный подход и обычно быстрее для простых однократных черновиков при низких разрешениях.

Могу ли я использовать gpt-image-1 через TheRouter с OpenAI SDK?

Да. gpt-image-1 полностью совместим с OpenAI Images API. Направьте ваш OpenAI SDK-клиент на https://api.therouter.ai/v1, укажите модель "openai/gpt-image-1" и используйте эндпоинт images.generate() или /v1/images/generations. Gpt-image-1 использует Images API, а не Chat Completions API.

Есть ли более дешёвая альтернатива gpt-image-1?

Да. OpenAI предлагает gpt-image-1-mini, который примерно на 80% дешевле gpt-image-1 при сохранении достойного качества для большинства сценариев. Кроме того, gpt-image-1 имеет три уровня качества (низкий, средний, высокий) — выбор «низкого» качества значительно снижает стоимость за изображение для черновиков и быстрых итераций.

переработано TheRouteren.wikipedia.org ↗
Какие функции безопасности есть у gpt-image-1?

gpt-image-1 включает C2PA-метаданные происхождения во всех сгенерированных изображениях, настраиваемую модерацию контента через параметр moderation (auto или low) и стек безопасности, ограничивающий создание вредоносных изображений. OpenAI по умолчанию не обучается на данных клиентов API.

Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релизаopenai.com ↗2026-05-29проверено
Архитектураdevelopers.openai.com ↗2026-08-11проверено
Нативные разрешенияdevelopers.openai.com ↗2026-08-11проверено
Форматы выводаdevelopers.openai.com ↗2026-08-11проверено
Поддержка фонаdevelopers.openai.com ↗2026-08-11проверено
Макс. изображений за вызовdevelopers.openai.com ↗2026-08-11проверено
Уровни качестваdevelopers.openai.com ↗2026-08-11проверено
Лицензия——проверено
GIE-Bencharxiv.org ↗2026-05-29проверено
STRICT text-renderingarxiv.org ↗2026-05-29неизвестно
OpenAI запускает ChatGPT Images 2.0 с gpt-image-2openai.com ↗2026-05-29проверено
OpenAI выпускает gpt-image-1.5 с 4-кратным ускорениемtechcrunch.com ↗2026-05-29проверено
OpenAI запускает gpt-image-1 в APIopenai.com ↗2026-05-29проверено
Чем gpt-image-1 отличается от DALL·E 3?openai.com ↗2026-05-29к проверке
Есть ли более дешёвая альтернатива gpt-image-1?en.wikipedia.org ↗2026-05-29к проверке
Какие функции безопасности есть у gpt-image-1?openai.com ↗2026-05-29к проверке
Помощь и контакты