Skip to main content
POST
Image editing: edit or fuse reference images with locked output size
Интерактивный Playground справа поддерживает прямую загрузку локальных изображений. Введите ваш API Key в поле Authorization (формат: Bearer sk-xxx), выберите изображение, задайте prompt / model / size, затем нажмите отправить.
Область применения: эта страница предназначена для редактирования или объединения одного или нескольких референсных изображений. Запрос использует multipart/form-data. Для чистой генерации изображений по тексту см. эндпоинт Text-to-Image.Отличие от gpt-image-2-all: идентичная структура вызова, только с одним дополнительным полем size. Если вам не нужно фиксировать размеры и нужен максимально быстрый результат, используйте gpt-image-2-all.
🖥️ Ограничение браузерного PlaygroundЭтот endpoint по умолчанию возвращает строку base64 (b64_json), которая может занимать несколько MB, поэтому браузерный Playground может показывать 请求时发生错误: unable to complete requestзапрос на самом деле успешно выполнен; браузер просто не может отобразить такую длинную строку base64.Рекомендуемый рабочий процесс: если вам нужен base64 или требуется загрузить очень большие референсные изображения, скопируйте приведенный ниже пример кода и запустите его локально.
📎 Порядок объединения нескольких изображений важенПоле image принимает несколько референсных изображений. Порядок является основой для ссылок “image1 / image2 / image3” в вашем prompt. Явно указывайте их в prompt, например:
Поместите человека из image1 в сцену image2, в стиле живописи image3
Рекомендуется ≤ 10 MB на изображение, форматы png / jpg / webp. Слишком большие изображения могут упереться в лимиты шлюза.
🎯 Редактирование с сохранением формы: когда вы передаете size=auto (или не указываете size), output наследует соотношение сторон того референсного изображения, которое prompt называет целью редактированияне обязательно первого в сценариях с несколькими изображениями.Например, при prompt “измените image2, подберите одежду и шляпу image2 под image1”, если image2 имеет формат 1:1, output тоже будет 1:1 (даже если image1 — пейзажный формат 16:9).Это полезно для замены одежды, добавления аксессуаров, ретуши и других редактирований с сохранением формы. Если prompt не указывает цель, модель определит ее сама; передавайте явный 30-бакетный size только тогда, когда вам нужно изменить соотношение сторон.
⚠️ Важные замечания по параметрам
  • size: для редактирования предпочтительно auto (или не указывать поле) — модель сохраняет соотношение сторон того референсного изображения, которое prompt называет целью редактирования, а не обязательно первого в сценариях с несколькими изображениями. Например, при prompt “измените image2, подберите одежду image2 под image1” соотношение сторон output совпадает с image2; если prompt не снимает неоднозначность, модель решит сама. Чтобы принудительно задать другой размер, выберите один из 30 поддерживаемых размеров; используйте строчные ASCII x, например 2048x1360, 3840x2160. Полная таблица: страница обзора.
  • quality: ❌ отклонено — не передавайте.
  • n: ❌ отклонено — одно изображение на вызов.
  • response_format: если не указывать, возвращается base64 (raw, без префикса, проверено в июле 2026); передавайте "url" для получения URL изображения. Компаниям, которые зависят от output в виде URL, следует переключить свой token на группу image2_OSS, чтобы получать детерминированный output URL без fallback на base64.

Примеры кода

Python

Редактирование одного изображения:
Слияние нескольких изображений:

cURL

Редактирование одного изображения:
Слияние нескольких изображений:

Node.js (нативные fetch + FormData)

JavaScript в браузере (объекты File)

Параметры

Многоходовая итерация: передавайте предыдущий результат обратно как image следующего вызова с новой инструкцией по правке, чтобы постепенно уточнять результат. Каждый раунд может задавать свой собственный size.

Формат ответа

Как и в endpoint text-to-image: по умолчанию возвращает base64 (data[0].b64_json, сырой base64 без префикса, проверено в июле 2026). Для URL изображения явно передайте response_format: "url"; компаниям, которым нужен вывод URL, следует перевести свой token в группу image2_OSS для детерминированного вывода URL без fallback на base64. data[0] возвращает либо url, либо b64_json — никогда не оба варианта. Режим b64_json (по умолчанию):
Режим url (явно передайте response_format: "url"; используйте группу image2_OSS, если вам нужны URL):
Проверено в июле 2026: поле b64_json — это сырой base64 без префикса data: — декодируйте его или добавьте префикс самостоятельно перед рендерингом. В более ранних версиях префикс действительно присутствовал, поэтому сначала всегда проверяйте startsWith('data:'), чтобы обработать оба варианта.

Связанные ресурсы

Обзор модели (полная таблица размеров)

Полная таблица 30 размеров, цены, технические характеристики

API для генерации изображений по тексту

/v1/images/generations совместимый эндпоинт

Сопутствующая модель gpt-image-2-all

Тот же формат вызова, когда вам не нужен фиксированный размер — более быстрый вывод

Авторизации

Authorization
string
header
обязательно

API Key from the API易 Console

Тело

multipart/form-data
model
enum<string>
по умолчанию:gpt-image-2-vip
обязательно

Model name, fixed to gpt-image-2-vip

Доступные опции:
gpt-image-2-vip
prompt
string
обязательно

Edit/fusion instruction. For multi-image flows, reference upload order as image1/image2/image3

Пример:

"Place the person from image1 into the scene of image2, in the style of image3"

image
file[]
обязательно

Reference images. For a single image, send the field once; for multiple images, repeat the same image field (e.g., -F [email protected] -F [email protected]) — upload order maps to image1 / image2 / ... in the prompt. Recommended ≤ 10MB each, formats png / jpg / webp.

size
enum<string>

Output size. For editing, prefer auto (or omit the field) — the model preserves the aspect ratio of whichever reference image the prompt names as the target of the edit (not necessarily the first one in multi-image scenarios). For example, with the prompt "modify image2, change image2's outfit to match image1", the output ratio matches image2. If the prompt doesn't disambiguate, the model decides on its own. To force a different dimension, pick one of the 30 supported sizes; format: WIDTHxHEIGHT with lowercase ASCII x, e.g., 2048x1360, 3840x2160. Flat $0.03/image across all tiers.

Доступные опции:
auto,
1280x1280,
848x1280,
1280x848,
960x1280,
1280x960,
1024x1280,
1280x1024,
720x1280,
1280x720,
1280x544,
2048x2048,
1360x2048,
2048x1360,
1536x2048,
2048x1536,
1632x2048,
2048x1632,
1152x2048,
2048x1152,
2048x864,
2880x2880,
2336x3520,
3520x2336,
2480x3312,
3312x2480,
2560x3216,
3216x2560,
2160x3840,
3840x2160,
3840x1632
Пример:

"2048x1360"

Ответ

Image successfully generated. Defaults to base64 in data[0].b64_jsonurl is not returned in the same response.

Image editing response. Returns base64 by default (data[0].b64_json); to get a url, switch to the image2_OSS group with response_format=url. data[0] returns either url or b64_json, never both.

data
object[]

Result array (this model returns 1 image per call)

created
integer

Unix timestamp (seconds)

usage
object

Token usage statistics