size снова доступен (обновлено 2026-07-22): при явной передаче size теперь размеры вывода фиксируются, как и ожидается, а справочная таблица из 30 размеров на этой странице снова действует. Примечание: size работает только на эндпоинтах /v1/images/generations и /v1/images/edits — чат-эндпоинт /v1/chat/completions не поддерживает параметр size, поэтому генерация изображений через chat не может фиксировать размеры. За актуальным статусом см. раздел Живые обновления.Обзор
gpt-image-2-vip — это реверс-инжиниринговая модель генерации изображений GPT в линейке Codex, доступная на платформе APIYI. Та же фиксированная стоимость $0.03/image , что и уgpt-image-2-all, и идентичный формат запроса/ответа — единственное существенное отличие в том, что vip принимает поле size с 30 распространенными размерами (10 соотношений сторон × 3 уровня разрешения: 1K Fast / 2K Recommended / 4K Detail), включая 4K.
gpt-image-2-vip, когда вам нужно зафиксировать размер вывода (hero-изображения для e-commerce, шаблоны постеров, миниатюры видео, обои 4K и т. д.). Просто замените поле model на gpt-image-2-vip и добавьте поле size — весь остальной код остается таким же, как у gpt-image-2-all.API преобразования текста в изображение
/v1/images/generations — текстовый prompt + size для явного задания размеров вывода.API редактирования изображений
/v1/images/edits — multipart-загрузка с инструкциями по редактированию/объединению.Ключевые отличия от gpt-image-2-all
gpt-image-2-vip и gpt-image-2-all — оба каналы, созданные путем реверс-инжиниринга, с одинаковой ценой и одинаковым кодом вызова. Они зеркально повторяют друг друга — достаточно переключить поле model в одном и том же запросе, и поведение в основном идентично. Отличия:
Основные возможности
Фиксированный размер вывода
size поддерживает 30 распространенных размеров — hero-изображения для e-commerce, шаблоны постеров, обои 4K — все выводится с точным числом пикселей.4K с высоким разрешением
Единая стоимость для всех размеров
Тот же формат вызова, что и -all
gpt-image-2-all — переключайте модели, меняя только строку model.Высококачественный рендеринг текста
Поддержка китайских prompt
Редактирование на естественном языке
Поддержка стандартных эндпоинтов
/images/generations и /images/editsТарификация
- Фиксированная цена $0.03/image для всех 30 размеров — без доплаты за 4K Detail
- Неудачные запросы не тарифицируются (ошибки аутентификации, ошибки проверки параметров)
- Для N изображений вызывайте API N раз параллельно
Настройка группы
gpt-image-2-vip находится в группе Default — дополнительная группа не нужна. На реверс-канале сейчас стабильная доступность, поэтому нет сценария резервного перехода на enterprise-группу, как у официального релея gpt-image-2.
Нужен детерминированный вывод URL → переключитесь на группу image2_OSS
По измерениям в июле 2026 года в группе по умолчанию, gpt-image-2-vip (и gpt-image-2-all) возвращают b64_json, когда response_format не указан; передайте response_format: "url" явно, чтобы получить URL изображения. Формат вывода группы по умолчанию не гарантирован — исторически по умолчанию использовался url с переходом на b64_json при нагрузке, и это менялось между версиями канала.
Если ваш бизнес зависит от вывода URL (запись URL напрямую в базу данных, отображение на frontend по URL, base64 неприемлем), переключите группу вашего token на image2_OSS — группу, специально созданную для детерминированного вывода URL, с коэффициентом тарифа 1x (без надбавки), действующую для обеих реверс-моделей gpt-image-2-vip и gpt-image-2-all. Она гарантирует, что ответ всегда содержит URL изображения и никогда не переходит на base64.

Token creation: set billing mode to "pay-as-you-go first" and pick the image2_OSS group (1x) — use it when you need deterministic URL output
image2Enterprise: /en/live/2026-04/image2-enterprise-stable
Технические характеристики
Эндпоинты
gpt-image-2-vip совместим с теми же двумя эндпоинтами, что и gpt-image-2-all. Просто замените поле model и при необходимости добавьте size:
Поддерживаемые размеры (полная таблица из 30 размеров)
gpt-image-2-vip поддерживает 10 соотношений сторон × 3 уровня разрешения = 30 размеров. Передавайте size: "WIDTHxHEIGHT" (нижний регистр ASCII x) напрямую в теле запроса.
1K Быстрый — черновики и недорогие итерации
2K Рекомендуемый — уровень по умолчанию (большинство готовых материалов)
4K Детальный — крупноформатные материалы
size, не передавайте quality):
Лучшие практики
Сжимайте входные изображения до менее 1.5MB (редактирование изображений / слияние нескольких изображений)
shell_api_error / Unknown error чаще всего вызываются слишком большими входными данными — сжатие заметно повышает вероятность успеха и снижает задержку. Выходное разрешение определяется полем size, а не размером входных данных — уменьшение входа только ускоряет процесс, но не снижает качество. Набивание 4K / 8K в prompt не создает изображение 4K; разрешение задается size, а не лишним текстом в prompt.Выбирайте размерный уровень по итоговому результату
Используйте строчную ASCII x в размере
"size": "1536x1024" — не 1536×1024 и не заглавную X.Не передавайте quality или n
quality отклоняется; n возвращает 1 изображение за вызов независимо — для нескольких изображений вызывайте параллельно.Используйте тайм-аут 300s
Выбирайте формат ответа по потребности
b64_json для прямого рендеринга в web; url для хранения/передачи на стороне сервера.Делитесь кодом с -all
model между gpt-image-2-all и gpt-image-2-vip по мере необходимости. Используйте vip, когда нужен фиксированный размер, и возвращайтесь к -all для самой быстрой итерации.Коды ошибок и повторные попытки
- Таймаут запроса начиная с 300 секунд (с запасом; обычно 90–150s, но для 4K Detail и пиковых хвостов требуется больше)
- Используйте экспоненциальную задержку для 5xx и таймаутов (рекомендуется 2–3 повторные попытки)
- Логируйте заголовок ответа
request-idдля отладки
FAQ
Могу ли я делиться кодом между vip и -all?
Могу ли я делиться кодом между vip и -all?
/v1/images/generations, /v1/images/edits) используют одинаковые поля запроса, поля ответа и поведение префикса b64_json. Единственные различия:- поле
model:gpt-image-2-vip↔gpt-image-2-all - поле
size: vip принимает набор из 30 размеров; -all отклоняетsize(размер вместо этого указывается в prompt)
if model == 'vip': payload['size'] = ....Почему vip настолько медленный?
Почему vip настолько медленный?
gpt-image-2-vip использует обратный канал Codex — типично 90–150 секунд, сопоставимо с официальным gpt-image-2 (100–120с) и медленнее, чем ChatGPT-web-line gpt-image-2-all (30–60с). Для задач, чувствительных к задержке, лучше использовать gpt-image-2-all; переключайтесь на vip только когда вам нужны фиксированный размер или 4K.Обязательно ли размер должен быть точно из таблицы? Что, если я отправлю 1024x768?
Обязательно ли размер должен быть точно из таблицы? Что, если я отправлю 1024x768?
invalid_request_error. Выберите ближайший уровень для вашего результата.Почему 4K часто возвращает 500? Как получить надежный 4K?
Почему 4K часто возвращает 500? Как получить надежный 4K?
3840x2160 / 2880x2880), ошибки status_code: 500 проще спровоцировать, при этом upstream возвращает invalid_request_error:- Отдавайте предпочтение 2K Recommended (например,
2048x1360/2048x2048) — заметно более высокий процент успеха, та же $0.03/image - Передавайте меньше входных изображений для img2img / слияния нескольких изображений — обратный канал Codex хуже работает при большой входной нагрузке, что еще сильнее повышает частоту сбоев 4K; предварительное сжатие каждого входного изображения ниже 1.5MB тоже помогает
- Для гарантированного 4K — переключитесь на официальный-прокси
gpt-image-2+image2Enterpriseгруппа. 4K через официальный-прокси дороже (~$0.3+/image), но заметно стабильнее — подходит, когда поставка 4K является жестким требованием.
Нужно ли сжимать входные изображения? Помогает ли написать 4K / 8K в prompt?
Нужно ли сжимать входные изображения? Помогает ли написать 4K / 8K в prompt?
shell_api_error / Unknown error чаще всего вызываются слишком большими входными данными, а сжатие заметно повышает процент успеха и снижает задержку. Примечание: 1.5MB — рекомендуемый верхний предел для надежности и скорости; число 10MB в FAQ выше — это жесткий лимит шлюза.Не беспокойтесь, что сжатие ухудшит качество — выходное разрешение определяется параметром size, а не размером входа. Уменьшение входа только ускоряет работу.Добавление 4K / 8K в prompt на самом деле не дает выход 4K. Если в prompt вы пишете 8K ultra HD, но для size задаете 1024x1024, вы все равно получите изображение качества 1K. Для 4K задавайте это в поле size — 1K / 2K / 4K стоят одинаково: фиксированные $0.03/image во всем наборе из 30 размеров.📖 Источник: /en/live/2026-05/gpt-image-2-vip-unknown-error4K действительно не облагается дополнительной платой?
4K действительно не облагается дополнительной платой?
3840x2160 / 2880x2880 и т. д.) стоит те же $0.03/image, что и 1K и 2K.Поддерживается ли n? Что будет, если я передам n=3?
Поддерживается ли n? Что будет, если я передам n=3?
n=3 в запросе, billing составит 0.03 × 3 = $0.09, но фактически будет возвращено только 1 изображение. Уберите поле n, чтобы избежать лишних списаний.Если контент отклонен или модель отвечает 'I can't do that', будет ли это тарифицироваться?
Если контент отклонен или модель отвечает 'I can't do that', будет ли это тарифицироваться?
- ✅ Предварительно фильтруйте и предупреждайте пользователей: добавьте фильтр по ключевым словам/сценариям на фронтенде или шлюзе (имена реальных людей, защищенные авторским правом персонажи, чувствительные темы) и показывайте подсказку в UI вроде “Celebrity / IP topics may fail and still be billed by upstream policy.” Это резко сокращает бесполезные списания.
- ✅ Ежемесячное возмещение для consumer-продуктов: мы понимаем, что consumer-facing продукты не могут полностью ограничивать ввод пользователей. Если ваши ежемесячные расходы достаточно велики ($1000+/month), вы можете ежемесячно пакетно выгружать логи (вызовы с низкой задержкой обычно являются мягкими отказами) и обращаться в поддержку за разовым ручным кредитом — не нужно подавать апелляцию по каждому вызову.
Нужно ли добавлять префикс data:image/png;base64, к b64_json?
Нужно ли добавлять префикс data:image/png;base64, к b64_json?
b64_json — это raw base64 без префикса data:: декодируйте его, чтобы записать файл, или добавьте префикс сами перед рендерингом; ранние версии действительно включали префикс. Добавьте в код проверку startsWith('data:'): если префикс присутствует, используйте значение напрямую как img src; если нет, сначала декодируйте или добавьте префикс — это предотвращает двойное добавление префикса или декодирование строки с префиксом в поврежденное изображение.Каков максимальный размер reference image и какие форматы поддерживаются?
Каков максимальный размер reference image и какие форматы поддерживаются?
png / jpg / webp. Слишком большие изображения могут упереться в лимиты шлюза. Каждое изображение при слиянии нескольких изображений должно соответствовать этому ограничению.Как долго действуют возвращенные URLs изображений? Нужно ли их скачивать?
Как долго действуют возвращенные URLs изображений? Нужно ли их скачивать?
url ответа в режиме url — это ссылка R2 CDN, которая истекает примерно через 1 день (24 часа); запросы после этого вернут 404.Настоятельно рекомендуется: сразу после генерации скачивайте и сохраняйте сгенерированные изображения в собственное object storage (S3 / OSS / R2), CDN или базу данных.Поддерживается ли streaming?
Поддерживается ли streaming?
Могу ли я использовать официальный OpenAI SDK?
Могу ли я использовать официальный OpenAI SDK?
base_url на https://api.apiyi.com/v1 и установите api_key в ваш token APIYI. client.images.generate(model="gpt-image-2-vip", size="2048x1360", prompt=...) работает напрямую.Могу ли я по-прежнему генерировать изображения через /v1/chat/completions?
Могу ли я по-прежнему генерировать изображения через /v1/chat/completions?
/v1/images/generations и /v1/images/edits (так стабильнее, и тот же код работает с официальным релеем gpt-image-2).Стиль на основе chat имеет смысл только в двух сценариях: многошаговое итеративное редактирование или передача онлайн URLs изображений напрямую. Учтите, что когда намерение на изображение неоднозначно, модель может вернуть обычный текст вместо изображения (добавьте перед prompt фиксированный префикс вроде “Generate an image:”, чтобы усилить запрос).Полные параметры см. в справке по chat-based API.Когда стоит переходить на официальный gpt-image-2?
Когда стоит переходить на официальный gpt-image-2?
quality (low/medium/high), локальная перерисовка на основе маски или строгое соответствие полям OpenAI-API — используйте gpt-image-2. См. Сравнение Official и Reverse.Связанная документация
- Обзор GPT-Image-2-All - Сестринская модель с той же ценой и более быстрым выводом, идеально подходит, когда вам не нужно фиксировать размер
- ⚖️ Сравнение официальной и реверс-версии - Наглядное руководство по выбору в сравнении с официальным
gpt-image-2(охватывает-all/-vip) - Песочница Text-to-Image - совместимый с
/v1/images/generationsэндпоинт, передайтеsize, чтобы зафиксировать размеры - Песочница редактирования изображений - многоизображенческое объединение и редактирование
/v1/images/edits - Официальный GPT-Image-2 - Для параметра
quality/ перерисовки по маске / строгого соответствия полей OpenAI-API - Обзор серии GPT-Image - Сравнение официального GPT-Image
- Руководство по API - Общие правила вызова
gpt-image-2.