Назад к моделям

Qwen Image Edit

qwenqwen/qwen-image-edit

Alibaba Qwen team's image-edit model built on the 20B Qwen-Image. Excels at text rendering inside images and semantic + appearance edits.

Qwen Image Edit — модель Alibaba Qwen для image-to-image редактирования, построенная на 20B foundation-модели Qwen-Image. Она предназначена не для чата, а для точных визуальных правок: вы передаёте исходное изображение и инструкцию на естественном языке, модель возвращает изменённую картинку. Главное отличие — text-aware editing, особенно китайский и английский текст внутри постеров, вывесок, каллиграфии, UI-скриншотов и товарной графики, где многие редакторы размывают символы или лишний раз перерисовывают макет.

По описанию Qwen, модель использует двойной путь управления: исходное изображение подаётся в Qwen2.5-VL для семантического контроля и в VAE encoder для контроля внешнего вида. Поэтому она покрывает как semantic edits (повернуть объект, изменить стиль портрета, сохранить персонажа/IP при смене сцены), так и appearance edits (локально добавить, удалить, перекрасить или заменить объект, сохранив остальную картинку стабильной). Через TheRouter модель доступна как qwen/qwen-image-edit на OpenAI-compatible image endpoint по фиксированной цене $0.048 за выходное изображение.

Когда выбирать
  • • Правка текста внутри готовых визуалов — замена китайского или английского текста на постерах, упаковке, скриншотах, вывесках и каллиграфии с сохранением ощущения шрифта, размера, макета и окружения.
  • • Итерации локализованных маркетинговых материалов — адаптация креативов для китайского/английского рынков без пересборки всего изображения в дизайн-инструменте.
  • • Ретушь продуктов и сцен — добавить или убрать вывеску, перекрасить конкретный объект, заменить фон или изменить одежду, сохраняя неизменяемые области.
  • • Вариации персонажей/IP — поворот маскота, создание вариантов emoji-pack или перенос портрета в новый стиль с сохранением семантической идентичности.
Когда не выбирать
  • • Чистая text-to-image генерация — используйте qwen/qwen-image, Doubao Seedream или GPT Image, если нет исходного изображения, которое нужно сохранить.
  • • Высокообъёмные batch-задачи с несколькими выходами — базовый qwen-image-edit возвращает одну картинку; для 1–6 выходов или кастомного разрешения нужны Plus/Max/2.0 варианты.
  • • Детерминированный pixel-perfect дизайн-QA — seed помогает относительной стабильности, но image editing остаётся вероятностным и может отличаться между вызовами.
  • • Видео, аудио или редактируемые layered-файлы — модель возвращает растровые PNG-style результаты, а не видео, аудио, PSD/Figma layers, маски или vector files.
Размер контекста
--
Максимальный вывод
--
Цена Изображениеза запрос
$0.0486за изображение
Цена Входза запрос
$0.0432за 1 млн токенов

Модальности

ТекстИзображение→Изображение

Возможности

ЗрениеГенерация изображенийРедактирование изображений

Возможности генерации медиа

image_edit
sizes
  • 1328x1328
  • 1664x928
  • 1472x1140
  • 1140x1472
  • 928x1664
max_reference_images
1
defaults
size
1328x1328

Разбивка цен

ТипСтавка
Изображение$0.0486 за изображение
Вход$0.0432 за 1 млн токенов
Per image$0.0486 за изображение

Per-image flat fee. Alibaba Model Studio international list price $0.045/image (alibabacloud.com/help/en/model-studio/model-pricing, read 2026-07-29).

Поддерживаемые параметры

promptsizeimageseedcfgnum_inference_steps

Характеристики

Дата релиза2025-08-18github.com ↗проверено
Базовая модельQwen-Image, 20B MMDiT foundation-модель для изображенийqwenlm.github.io ↗проверено
Архитектура редактированияДвойной контроль: семантическое представление Qwen2.5-VL плюс appearance/reconstruction представление VAEarxiv.org ↗проверено
Входные модальностиТекстовая инструкция плюс одно или несколько изображений; каталог TheRouter показывает text+image inputwww.alibabacloud.com ↗проверено
ВыходОдна отредактированная PNG-картинка для базового варианта qwen-image-editwww.alibabacloud.com ↗проверено
Языки редактирования текстаQwen явно выделяет редактирование китайского и английского текстаqwenlm.github.io ↗проверено
Требования к входным изображениямJPG/JPEG, PNG, BMP, TIFF, WEBP, первый кадр GIF; в документации Alibaba рекомендуются ширина/высота 384–3072 px и максимум 10 MBwww.alibabacloud.com ↗проверено
Цена TheRouter$0.048 за выходное изображениеtherouter.ai ↗проверено
Дата отсечения данныхНе раскрытонеизвестно

Бенчмарки

BenchmarkDistributionScoreSource
Public image-editing benchmarks
В launch blog сказано, что Qwen-Image-Edit достигает SOTA на нескольких публичных image-editing benchmarks, но численная таблица не опубликована. Считайте это качественным vendor claim, пока не проведёте собственный eval set.
SOTA claimed by Qwen; numeric scores not disclosed in launch blogqwenlm.github.io ↗
Qwen-Image technical report
В arXiv report согласованность редактирования связывается с multi-task TI2I/I2I training и двойным кодированием Qwen2.5-VL + VAE.
State-of-the-art editing performance reportedarxiv.org ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

Рекомендуется асинхронный API

Генерация изображений обычно занимает 30–180 секунд и не укладывается в edge timeout синхронного запроса. Ниже используется схема ?async=true + polling. Открыть полный гид по асинхронной генерации и редактированию изображений →

cURL
# 1) Submit job (returns 202 immediately with a polling URL).
# Image generation takes 30-180s — always use the async path in production.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/generations?async=true"   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "qwen/qwen-image-edit",
    "prompt": "A cinematic product render with soft studio lighting"
  }' | python3 -c "import sys,json;print(json.load(sys.stdin)['id'])")
echo "submitted: $JOB"

# 2) Poll until terminal (succeeded / failed / cancelled / expired).
while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THE_ROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['status'])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['unsigned_urls'][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

Гид по API

Редактирование изображений

Отправьте исходное изображение и инструкцию редактирования в OpenAI-compatible image endpoint TheRouter. Для локальных файлов используйте base64, для уже размещённых assets — URL.

cURL
curl https://api.therouter.ai/v1/images/generations \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen-image-edit",
    "prompt": "Replace the headline with: TheRouter AI Gateway. Keep the same font style, layout, and background.",
    "image": "data:image/png;base64,iVBORw0KGgoAAAANSUhEUg...",
    "seed": 12345,
    "cfg": 4.0,
    "num_inference_steps": 50
  }'

Примеры редактирования изображений

Загрузите изображение и опишите нужное изменение текстовым prompt; модель вернёт отредактированную картинку в base64.

cURL
# Same async submit + poll pattern as /v1/images/generations.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/edits?async=true"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -F "model=qwen/qwen-image-edit"   -F "prompt=Turn this scene into a watercolor painting"   -F "size=1024x1024"   -F "image=@input.png" | python3 -c "import sys,json;print(json.load(sys.stdin)['id'])")
echo "submitted: $JOB"

while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THE_ROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['status'])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['unsigned_urls'][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

Ещё от qwen

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2025-12-23

Qwen выпускает веса Qwen-Image-Edit-2511

Репозиторий Qwen-Image указывает Edit-2511 как более поздний image-edit релиз с весами Hugging Face и ModelScope, а также day-0 acceleration и inference-stack support. Для пользователей TheRouter это lifecycle signal: базовый маршрут qwen/qwen-image-edit полезен сейчас, но перед фиксацией долгоживущих production workflows стоит сравнить его с новыми Qwen edit вариантами.

переработано TheRoutergithub.com/QwenLM ↗
2025-09-22

Qwen представляет месячную итерацию Qwen-Image-Edit-2509

Публичный changelog Qwen показывает, что качество image editing быстро менялось после августовского базового релиза. Считайте prompts, seeds и acceptance tests version-sensitive: creative QA set, прошедший на одном Qwen edit route, может потребовать re-baseline на следующих версиях.

переработано TheRoutergithub.com/QwenLM ↗
2025-08-18

Qwen открывает Qwen-Image-Edit

Alibaba Qwen выпустила editing-версию Qwen-Image, перенеся сильные стороны 20B модели в text rendering на image editing. Запуск подчёркивал semantic editing, appearance-preserving local edits и прямую замену китайского/английского текста внутри изображений.

переработано TheRouterqwenlm.github.io ↗

Частые вопросы

Qwen Image Edit — text-to-image модель или image editor?

Это прежде всего image editor: отправьте существующее изображение и инструкцию, получите отредактированную картинку. Для создания изображения с нуля выбирайте text-to-image модель.

переработано TheRouterqwenlm.github.io ↗
Почему выбирать Qwen Image Edit вместо FLUX Kontext?

Выбирайте Qwen, когда сложность — редактирование китайского/английского текста внутри готового изображения или сохранение poster typography. Выбирайте FLUX Kontext для быстрых итеративных правок, character consistency или если Kontext workflow уже есть в вашем стеке. Для ценных assets прогоните оба на небольшом QA set.

переработано TheRouterqwenlm.github.io ↗
Может ли она редактировать несколько входных изображений?

В справочнике Alibaba Model Studio указано, что qwen-image-edit поддерживает single-image editing и multi-image fusion, при этом базовый вариант выдаёт одну картинку. Через TheRouter проверьте допустимую форму image payload в вашем клиенте перед production multi-image flows.

переработано TheRouterwww.alibabacloud.com ↗
Делает ли seed редактирование детерминированным?

Нет. Seed повышает относительную стабильность, но справочник Alibaba прямо предупреждает, что image generation вероятностна и результаты могут отличаться даже с тем же seed. Для production asset pipelines используйте visual regression checks.

переработано TheRouterwww.alibabacloud.com ↗
Что логировать для production workflow с Qwen Image Edit?

Логируйте model id, hash исходного изображения (не raw private image, если policy не разрешает), версию prompt, seed, cfg/steps, обработку истечения output URL и статус human approval. Это делает creative QA воспроизводимым без лишнего хранения sensitive assets.

переработано TheRouterwww.alibabacloud.com ↗
Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релизаgithub.com ↗2026-07-22проверено
Базовая модельqwenlm.github.io ↗2026-07-22проверено
Архитектура редактированияarxiv.org ↗2026-07-22проверено
Входные модальностиwww.alibabacloud.com ↗2026-07-22проверено
Выходwww.alibabacloud.com ↗2026-07-22проверено
Языки редактирования текстаqwenlm.github.io ↗2026-07-22проверено
Требования к входным изображениямwww.alibabacloud.com ↗2026-07-22проверено
Цена TheRoutertherouter.ai ↗2026-07-22проверено
Дата отсечения данных——неизвестно
Public image-editing benchmarksqwenlm.github.io ↗2026-07-22к проверке
Qwen-Image technical reportarxiv.org ↗2026-07-22к проверке
Qwen выпускает веса Qwen-Image-Edit-2511github.com/QwenLM ↗2026-07-22проверено
Qwen представляет месячную итерацию Qwen-Image-Edit-2509github.com/QwenLM ↗2026-07-22проверено
Qwen открывает Qwen-Image-Editqwenlm.github.io ↗2026-07-22проверено
Qwen Image Edit — text-to-image модель или image editor?qwenlm.github.io ↗2026-07-22к проверке
Почему выбирать Qwen Image Edit вместо FLUX Kontext?qwenlm.github.io ↗2026-07-22к проверке
Может ли она редактировать несколько входных изображений?www.alibabacloud.com ↗2026-07-22к проверке
Делает ли seed редактирование детерминированным?www.alibabacloud.com ↗2026-07-22к проверке
Что логировать для production workflow с Qwen Image Edit?www.alibabacloud.com ↗2026-07-22к проверке
Помощь и контакты