Skip to main content

Краткий ответ

Используйте gpt-image-2 и добавьте в запрос два поля:
Изображение возвращается в формате PNG с настоящим альфа-каналом — дополнительная постобработка для вырезания не требуется. Поддерживаются как генерация изображений по тексту, так и редактирование изображений.
background: "transparent" — это возможность, которую OpenAI открыла для GPT-Image-2 21.08.2026 (OpenAI пометила её как предварительную версию). APIYI проверила её от начала до конца: и генерация изображений по тексту, и редактирование изображений возвращают настоящую прозрачность альфа-канала.

Какие модели могут создавать прозрачный фон

Если вам нужна надёжная прозрачность, используйте gpt-image-2. Параметр и запрос в промпте — не одно и то же: первое гарантируется API, а второе означает, что модель делает всё возможное. При обработке больших объёмов разница становится заметной.

Два способа вызвать его

Текст-в-изображение /v1/images/generations

Редактирование изображений /v1/images/edits

Передайте ему обычную фотографию и попросите удалить фон:
Инпейтинг на основе маски (mask) и прозрачный фон работают вместе — они не конфликтуют.

Почему jpeg не работает

У JPEG нет альфа-канала — прозрачность негде хранить. При сочетании output_format: "jpeg" с background: "transparent" возвращается 400:
Для прозрачности выберите png (без потерь, больше) или webp (с потерями и настраиваемый, меньше, также поддерживает альфа-канал). webp также принимает output_compression, чтобы уменьшить размер файла.

Редактирование — это перерисовка, а не точное вырезание

Сразу задайте ожидания: когда /v1/images/edits выполняется с background: transparent, модель понимает сцену и заново рисует объект, а не обводит исходный контур так, как это сделал бы Photoshop. Это означает:
  • Позу, стиль и мелкие детали объекта будет меняться — это не сохранение на уровне пикселей
  • Чтобы оставаться ближе к оригиналу, используйте quality: "high" и укажите в prompt: “сохраните исходную композицию, не меняйте внешний вид объекта”
  • Если вашему workflow нужно извлечение с точностью до пикселя, выполните вырезание самостоятельно с помощью rembg, PIL или sharp. Генерация модели лучше подходит для “создания переиспользуемых assets”, чем для точного matting

Не описывайте сцену в prompt — параметр не может её переопределить

background: "transparent" гарантирует только альфа-канал и направляет модель в сторону изолированного объекта. Если prompt или референсное изображение описывает полноценную сцену, модель рисует эту сцену, и параметр её не остановит. Это самая распространённая причина, почему прозрачный результат «иногда работает, иногда нет», и она никак не связана с уровнем качества. Измерено 2026-09-11 с gpt-image-2.5-sunburst, 30 вызовов (половина со средним качеством, половина с высоким, text-to-image плюс редактирование референсных изображений): Три правила написания:
  • ❌ Избегайте слов окружения — земля, небо, комната, лес. Если вам нужна атмосфера, привязывайте её к объекту («несколько падающих кленовых листьев», а не «кленовый лес»)
  • ✅ Завершайте каждый prompt строкой isolated subject on a transparent background, no scenery, no ground, no shadow
  • ✅ Если референсное изображение имеет фон, укажите remove the background entirely, keep only the character в prompt для редактирования
Повышение quality с medium до high не делает прозрачность надёжнее; оно лишь требует в 4 раза больше tokens (439 → 1,756).

Тарификация

Прозрачность не требует доплаты. При том же уровне качества и размере background: "transparent" и background: "opaque" используют абсолютно одинаковое количество image tokens и тарифицируются по обычным правилам за token для gpt-image-2.

Распространённые ошибки

output_format было задано как jpeg. Переключите его на png или webp.
Проверьте три вещи. Во-первых, что поле background действительно дошло до API — эндпоинт редактирования имеет тип multipart/form-data, поэтому это должно быть -F background=transparent, а не полем в теле JSON. Во-вторых, возвращает ли background верхнего уровня в ответе значение transparent. В-третьих, используете ли вы gpt-image-2 — у gpt-image-2-all и gpt-image-2-vip такого параметра нет, и они молча его игнорируют.Если все три условия выполнены, но вы всё равно получаете белый или полный фон, prompt (или эталонное изображение) почти наверняка описывает сцену — модель нарисовала окружение, которое её попросили создать, и параметр не может это переопределить. См. выше раздел «Не описывайте сцену в prompt».
Достаточно одного фрагмента Python:
Режим RGB означает, что альфа-канал полностью отсутствует. Режим RGBA, при котором все значения альфа равны 255, означает, что канал существует, но ничего не было вырезано.
Prompt лишь просит модель нарисовать это таким образом, а модель может нарисовать серо-белую шахматную сетку, которая только выглядит прозрачной, — это всё равно непрозрачные пиксели. Только параметр background: "transparent" гарантирует настоящий альфа-канал. Верно и обратное: параметр гарантирует канал, но не может переопределить сцену, описанную в prompt, — они должны работать вместе.

Связанная документация

Обзор GPT-Image-2

Полный список параметров, размеров, уровней качества и кодов ошибок

Справочник API преобразования текста в изображение

Все поля в /v1/images/generations

Справочник API редактирования изображений

/v1/images/edits и объединение нескольких изображений

Инпейтинг с маской

Используйте альфа-маску, чтобы отметить область для изменения

Официальные и обратные маршруты

Выбор между gpt-image-2.5-flare / sunburst / gpt-image-2 / -all / -vip

Артефакты на белом фоне

Другая проблема с чисто белым фоном