Обзор
gpt-image-2-all — это обратно-инженеренная модель генерации изображений GPT (линейка веб-версии ChatGPT), доступная на платформе APIYI. При чрезвычайно конкурентной цене $0.03/image за запрос она генерирует изображения примерно за 30–60 секунд и поддерживает text-to-image / редактирование одного изображения / слияние нескольких изображений / редактирование на естественном языке — с высокой точностью рендеринга текста и нативной поддержкой китайских prompt./v1/images/generations (text-to-image) и /v1/images/edits (image editing).Нужно зафиксировать размер вывода или 4K? Переключитесь на сестринскую модель gpt-image-2-vip — тот же формат вызова, только одно дополнительное поле size.API генерации изображений по тексту
/v1/images/generations — генерируйте изображения по текстовым prompt.API редактирования изображений
/v1/images/edits — многочастичная загрузка с инструкциями по редактированию/слиянию.Ключевые особенности
Очень выгодные цены
Качественный рендеринг текста
Поддержка prompt на китайском
Слияние нескольких изображений
Быстрый результат
gpt-image-2-vip, и официальный релей gpt-image-2Ускорение через R2 CDN
response_format: "url" явно для ссылок R2 CDN с глобальной доставкой с низкой задержкойРедактирование на естественном языке
Поддержка стандартных эндпоинтов
/images/generations и /images/editsТарифы
- Фиксированная цена; без уровней по разрешению, качеству или длине prompt
- Неудачные запросы не тарифицируются (ошибки аутентификации, ошибки проверки параметров)
- Для N изображений вызывайте API N раз параллельно
Настройка группы
gpt-image-2-all находится в группе Default — дополнительная группа не нужна. В reverse-канале сейчас стабильное наличие, поэтому здесь нет сценария запасного перехода на enterprise-группу, как у official-relay gpt-image-2.
Нужен детерминированный вывод URL → переключитесь на группу image2_OSS
По измерениям в июле 2026 года в группе по умолчанию gpt-image-2-all (и gpt-image-2-vip) возвращают b64_json, когда response_format опущен; передайте response_format: "url" явно, чтобы получить URL изображения. Формат вывода группы по умолчанию не гарантирован — исторически он по умолчанию использовал url с откатом к b64_json при нагрузке и менялся между версиями канала.
Если ваш бизнес зависит от вывода URL (сохранение URL напрямую в вашу базу данных, frontend-рендеринг по URL, base64 не подходит), переключите группу вашего token на image2_OSS — группу, специально созданную для детерминированного вывода URL, с коэффициентом тарифа 1x (без надбавки), которая действует для обеих reverse-моделей gpt-image-2-all и gpt-image-2-vip. Она гарантирует, что ответ всегда содержит URL изображения и никогда не откатывается к base64.

Token creation: set billing mode to "pay-as-you-go first" and pick the image2_OSS group (1x) — use it when you need deterministic URL output
image2Enterprise: /en/live/2026-04/image2-enterprise-stable
Технические характеристики
Эндпоинты
size? Используйте родственную модель gpt-image-2-vip — те же эндпоинты, только одно дополнительное поле size (30 явных размеров, включая 4K).Управление размером и соотношением сторон (описывайте в prompt)
gpt-image-2-all не имеет параметра size — размер задается в prompt. Если вам нужны строго фиксированные размеры вывода (hero-изображения для e-commerce, шаблоны постеров, обои 4K), используйте gpt-image-2-vip вместо этого.
Проверенная таблица «формулировка prompt → фактическое разрешение»
Восемь формулировок ниже эмпирически подтверждены и стабильно воспроизводятся. Поместите формулировку из первого столбца в начало prompt, и вы получите разрешение, указанное во втором столбце (все результаты находятся на уровне ~1.5K пикселей):- Все результаты находятся на уровне ~1.5K-пикселей (длинная сторона от 1500 до 2000 px). Это фактический потолок модели — это не по-настоящему «любое разрешение».
- Воспроизводимость максимальна, когда prompt только содержит формулировку из таблицы; добавление других слов про композицию вызывает дрейф.
- Китайские строки — это фактические значения, которые вы отправляете; рекомендуем оставлять их как есть, а не переводить.
Стилевые формулировки (без фиксированного разрешения)
Формулировки ниже не имеют проверенного разрешения — используйте их только как модификаторы стиля, в сочетании с таблицей выше:Как показывать эту таблицу вашим пользователям
Хотя уgpt-image-2-all нет size параметра, вы все равно можете предложить пользователям выпадающий список «Размер / Соотношение сторон», который выглядит почти как официальное поле size:
- Используйте формулировку prompt из таблицы выше как значение опции
value(например,横版 16:9) - Показывайте ожидаемое разрешение в подписи опции (например,
Landscape 16:9 (1672×941)), чтобы пользователи знали, что получат - На стороне backend добавляйте выбранную формулировку в начало исходного prompt пользователя перед отправкой в API
Лучшие практики
Сжимайте входные изображения до менее 1.5MB (редактирование изображений / слияние нескольких изображений)
4K / 8K тоже не даст изображение высокого разрешения; для надежного получения более крупного результата используйте проверенные формулировки в таблице «Проверенная формулировка prompt → фактическое разрешение» выше.Размещайте размер в начале prompt
Уверенно используйте текстовые элементы
Обозначайте порядок нескольких изображений
image, имеет значение. Явно указывайте его в prompt как «image1/image2/image3».Выбирайте формат ответа по задаче
b64_json для прямого веб-рендеринга; url для серверного хранения/пересылки.Используйте таймаут 300s
Убирайте неподдерживаемые параметры
gpt-image-2-all не принимает size, n, quality, aspect_ratio — их отправка может вызвать ошибки валидации. Чтобы пройти size, переключитесь на gpt-image-2-vip.Коды ошибок и повторные попытки
- Таймаут запроса — начиная с 300 секунд (консервативно; обычно 30–60s, но загрузка / скачивание изображений и пиковые хвосты обратного канала создают большую вариативность — 120s вызывает частые ложные таймауты)
- Используйте экспоненциальную задержку для 5xx и таймаутов (рекомендуется 2–3 повторные попытки)
- Логируйте заголовок ответа
request-idдля отладки
FAQ
Вижу и gpt-image-2-all, и gpt-image-2-vip — что выбрать?
Вижу и gpt-image-2-all, и gpt-image-2-vip — что выбрать?
size и времени генерации:- Не нужна строгая фиксация размера, нужен более быстрый результат →
gpt-image-2-all(~30–60 с, укажите размер в prompt). - Нужен закреплённый размер вывода или 4K →
gpt-image-2-vip(~90–150 с, 30 фиксированных размеров, включая 4K). - Нужна настройка
qualityили полное соответствие полям OpenAI-API → используйте официальныйgpt-image-2.
Можно ли генерировать несколько изображений за один раз?
Можно ли генерировать несколько изображений за один раз?
Поддерживает ли она параметр n? Что будет, если я передам n=3?
Поддерживает ли она параметр n? Что будет, если я передам n=3?
n=3 в запросе, тарификация составит 0.03 × 3 = $0.09, но фактически будет возвращено только 1 изображение. Обязательно удалите поле n из запросов, чтобы избежать лишних списаний.Если контент отклонён или модель отвечает «Я не могу этого сделать», тарифицируется ли это?
Если контент отклонён или модель отвечает «Я не могу этого сделать», тарифицируется ли это?
- ✅ Предварительно фильтруйте и предупреждайте пользователей: добавьте фильтр по ключевым словам/сценариям на фронтенде или шлюзе (имена реальных людей, защищённые авторским правом персонажи, чувствительные темы) и выводите подсказку в интерфейсе вроде «Темы со знаменитостями / IP могут не пройти и всё равно быть тарифицированы по политике upstream». Это резко сокращает лишние списания.
- ✅ Ежемесячная компенсация для consumer-продуктов: мы понимаем, что consumer-facing продуктам невозможно полностью ограничить пользовательский ввод. Если ваши ежемесячные расходы достаточно велики ($1000+/месяц), вы можете ежемесячно пакетировать логи (запросы с низкой задержкой обычно являются мягкими отказами) и обратиться в поддержку за разовой ручной компенсацией — не нужно подавать обращение по каждому вызову.
Нужно ли добавлять префикс data:image/png;base64, к b64_json?
Нужно ли добавлять префикс data:image/png;base64, к b64_json?
b64_json — это raw base64 без префикса data:: декодируйте его, чтобы записать файл, или добавьте префикс сами перед рендерингом; в более ранних версиях префикс действительно был. Добавьте в код проверку startsWith('data:'): если префикс присутствует, используйте значение напрямую как img src; если нет, сначала декодируйте или добавьте префикс — это поможет избежать двойного добавления префикса или декодирования строка с префиксом в битое изображение.Почему я получаю другой размер, хотя в prompt указано 1024x1024?
Почему я получаю другой размер, хотя в prompt указано 1024x1024?
cinematic, phone poster, square composition).Для формулировок, которые надёжно соответствуют конкретному разрешению, см. таблицу «Проверенная формулировка prompt → фактическое разрешение» ранее на этой странице (в разделе «Управление размером и соотношением сторон»).Нужно ли сжимать входные изображения? Помогает ли написание 4K / 8K в prompt?
Нужно ли сжимать входные изображения? Помогает ли написание 4K / 8K в prompt?
4K / 8K в prompt на самом деле не создаёт изображение высокого разрешения — это декоративные слова, и модель не повышает разрешение из-за них. Для надёжно большего вывода используйте проверенные формулировки из таблицы «Проверенная формулировка prompt → фактическое разрешение» выше (например, cinematic, phone poster, square composition). Для строгой фиксации размера или 4K переключитесь на gpt-image-2-vip (30 фиксированных размеров, включая 4K, по фиксированной цене $0.03/изображение).Каков максимальный размер референсного изображения и поддерживаемые форматы?
Каков максимальный размер референсного изображения и поддерживаемые форматы?
png / jpg / webp. Слишком большие изображения могут упереться в лимиты шлюза. Каждое изображение при слиянии нескольких изображений должно соответствовать этому лимиту.Как долго действуют возвращаемые URL изображений? Нужно ли их скачивать?
Как долго действуют возвращаемые URL изображений? Нужно ли их скачивать?
url ответа в режиме url — это ссылка R2 CDN, которая истекает примерно через 1 день (24 часа): после этого запросы будут возвращать 404.Настоятельно рекомендуется: сразу после генерации скачивайте и сохраняйте изображения в ваше собственное object storage (S3 / OSS / R2), CDN или базу данных. Не используйте возвращённый URL как постоянную прямую ссылку.Два рекомендуемых подхода:- Прокси на стороне сервера: сразу
requests.get(url)после ответа, сохраняйте в своё хранилище и возвращайте на фронтенд собственный URL; - Используйте
b64_json: добавьте"response_format": "b64_json"в запрос, чтобы получить base64-данные изображения напрямую — на одну кросс-доменную загрузку меньше, идеально для рендеринга на фронтенде или записи сразу в файл.
Поддерживает ли она потоковую передачу?
Поддерживает ли она потоковую передачу?
Можно ли использовать официальный OpenAI SDK?
Можно ли использовать официальный OpenAI SDK?
base_url на https://api.apiyi.com/v1 и задайте api_key как ваш APIYI token. Однако client.images.generate() по умолчанию отправляет size/n — эта модель отклоняет оба параметра, поэтому мы рекомендуем делать прямые HTTP-запросы с requests / fetch к /v1/images/generations и /v1/images/edits.Есть ли заметная разница между prompt на китайском и английском?
Есть ли заметная разница между prompt на китайском и английском?
Можно ли по-прежнему генерировать изображения через /v1/chat/completions?
Можно ли по-прежнему генерировать изображения через /v1/chat/completions?
/v1/images/generations и /v1/images/edits (так стабильнее, и тот же код работает с gpt-image-2 официального релея).Формат на основе chat имеет смысл только в двух сценариях: многоходовое итеративное редактирование или передача онлайн-URL изображений напрямую. Учтите, что если намерение изображения неоднозначно, модель может вернуть обычный текст вместо изображения (добавьте к prompt фиксированный префикс вроде «Сгенерируйте изображение:», чтобы усилить намерение).Полный список параметров см. в справке по API на основе chat.Связанная документация
- ⚖️ Сравнение официальной и реверс-версии - Руководство по выбору рядом с официальным
gpt-image-2 - Песочница Text-to-Image - Совместимый эндпоинт
/v1/images/generations - Песочница редактирования изображений - Многоизображенийное объединение и редактирование
/v1/images/edits - GPT-Image-2-VIP (та же цена, поддерживает
sizeи 4K) - Сестринская модель с той же ценой и 30 явными размерами (включая 4K); идентичный формат вызова - GPT-Image-2 Official (оплата по token) - Для параметра
quality/ перерисовки на основе маски / строгого соответствия полям OpenAI-API - Обзор серии GPT-Image - Официальное сравнение GPT-Image
- Сообщество: узлы Luck GPT-Image 2 ComfyUI - Вызывайте
gpt-image-2-allнапрямую в ComfyUI (два эндпоинта: chat_completions / images_api) - Сообщество: навыки APIYI GPT-Image 2 - Вызывайте из Codex CLI / Cursor / Gemini CLI и других AI-инструментов для кодирования одной строкой
- Руководство по API - Общие правила вызова