Skip to main content

Краткий ответ

Используйте gpt-image-2 и добавьте в запрос два поля:
Изображение возвращается в виде PNG с настоящим alpha-каналом — дополнительная постобработка для вырезки не требуется. Text-to-image, image editing и инструмент Responses для изображений поддерживают это.
background: "transparent" — это возможность, которую OpenAI предоставила для GPT-Image-2 2026-08-21 (OpenAI пометила это как preview). APIYI проверила это сквозным образом: и text-to-image, и image editing возвращают настоящую альфа-прозрачность.

Какие модели могут создавать прозрачный фон

Если вам нужна надёжная прозрачность, используйте gpt-image-2. Параметр и запрос в prompt — это не одно и то же: первое гарантируется API, второе — это максимум, на который способна модель. При пакетной обработке разница заметна.

Три способа вызова

Текст в изображение /v1/images/generations

Редактирование изображений /v1/images/edits

Дайте ему обычную фотографию и попросите убрать фон:
Инпейтинг на основе маски (mask) и прозрачный фон работают вместе — они не конфликтуют.

Инструмент изображений Responses

Возвращаемый image_generation_call повторяет "background": "transparent".

Почему jpeg не работает

У JPEG нет альфа-канала — прозрачность негде хранить. При сочетании output_format: "jpeg" с background: "transparent" возвращается 400:
Для прозрачности выберите png (без потерь, больше) или webp (с потерями и настраиваемый, меньше, также поддерживает альфа-канал). webp также принимает output_compression, чтобы уменьшить размер файла.

Редактирование — это перерисовка, а не точное вырезание

Сразу задайте ожидания: когда /v1/images/edits выполняется с background: transparent, модель понимает сцену и заново рисует объект, а не обводит исходный контур так, как это сделал бы Photoshop. Это означает:
  • Позу, стиль и мелкие детали объекта будет меняться — это не сохранение на уровне пикселей
  • Чтобы оставаться ближе к оригиналу, используйте quality: "high" и укажите в prompt: “сохраните исходную композицию, не меняйте внешний вид объекта”
  • Если вашему workflow нужно извлечение с точностью до пикселя, выполните вырезание самостоятельно с помощью rembg, PIL или sharp. Генерация модели лучше подходит для “создания переиспользуемых assets”, чем для точного matting

Тарификация

Прозрачность не требует доплаты. При том же уровне качества и размере background: "transparent" и background: "opaque" используют абсолютно одинаковое количество image tokens и тарифицируются по обычным правилам за token для gpt-image-2.

Распространённые ошибки

output_format был установлен в jpeg. Измените его на png или webp.
Проверьте три вещи. Во‑первых, что поле background действительно дошло до API — эндпоинт редактирования — multipart/form-data, поэтому это должно быть -F background=transparent, а не поле в теле JSON. Во‑вторых, повторяет ли верхнеуровневый background в ответе transparent. В‑третьих, используете ли вы gpt-image-2gpt-image-2-all и gpt-image-2-vip не имеют такого параметра и просто игнорируют его.
Достаточно одного фрагмента Python:
Режим RGB означает, что alpha-канал вообще отсутствует. Режим RGBA, при котором все значения alpha равны 255, означает, что канал существует, но ничего не было вырезано.
prompt лишь просит модель изобразить это таким образом, и модель может нарисовать серо-белую шахматную сетку, которая лишь выглядит прозрачной — это по‑прежнему непрозрачные пиксели. Только параметр background: "transparent" гарантирует настоящий alpha-канал.

Связанная документация

Обзор GPT-Image-2

Полные параметры, размеры, уровни качества и коды ошибок

Справочник API для text-to-image

Все поля на /v1/images/generations

Справочник API по редактированию изображений

/v1/images/edits и слияние нескольких изображений

Инпейтинг по маске

Используйте альфа-маску, чтобы отметить область, которую нужно изменить

Официальные и реверсные маршруты

Выбор между gpt-image-2 / -all / -vip

Артефакты на белом фоне

Другая проблема с чисто-белым фоном