Skip to main content
POST
Text-to-Image: generate image from text prompt
Интерактивная песочница справа поддерживает тестирование в реальном времени. Укажите ваш API Key в Authorization (формат: Bearer sk-xxx), введите prompt, выберите размер / качество и отправьте.
Сценарий использования: Эта страница предназначена для «генерации изображений по тексту». Просто введите prompt — загрузка изображения не требуется. Для редактирования по опорному изображению, объединения нескольких изображений или инпейнтинга маски используйте эндпоинт редактирования изображений.
🖥️ Ограничение браузерной песочницы (важно)Этот эндпоинт возвращает необработанную строку base64 (обычно несколько МБ) в ответе. Из-за ограничений рендеринга браузера песочница справа может показать 请求时发生错误: unable to complete request после получения ответа — запрос на самом деле успешно выполнен; браузер просто не может отобразить такую длинную строку base64.Рекомендуемый рабочий процесс (подходит для новичков):
  • Скопируйте пример на Python / Node.js / cURL ниже и запустите его локально. Код автоматически base64.b64decodes ответ и записывает изображение в файл.
  • Если вам все же нужно использовать встроенную в браузер песочницу, установите size на минимальный уровень (например, 1024x1024) и quality на low, чтобы уменьшить размер ответа.
Все API для изображений являются синхронными — ID задачи для опроса отсутствует, а если клиент отключится, результат будет потерян, хотя запрос все равно будет тарифицироваться. Установите для этой модели достаточно большой timeout; см. Основы API для изображений и лучшие практики.
⚠️ Неподдерживаемые параметры
  • input_fidelitygpt-image-2 принудительно включает высокую детализацию; при передаче этого параметра возвращается 400. При миграции с 1.5 просто удалите строку.
  • background: "transparent" — Прозрачный фон не поддерживается. Используйте opaque или выполните постобработку для прозрачности.
Результаты выше 2560×1440 остаются экспериментальными. Для production предпочитайте пресеты: 2048x1152 / 2048x2048 / 3840x2160.

Примеры кода

Python (OpenAI SDK)

Python (сырые запросы)

cURL

Node.js (нативный fetch)

JavaScript в браузере (прямой рендер)

Справка по параметрам

Не передавайте устаревшие значения DALL·E standard / hd для quality. Принимаются только четыре официальных значения enum low / medium / high / auto. Устаревшие значения ведут себя непоследовательно в разных backend-каналах: иногда они сразу завершаются с 400 (invalid_value), а иногда молча игнорируются, и запрос выполняется на auto (непредсказуемая стоимость). Всегда явно передавайте одно из четырех официальных значений.
Подробные ограничения, допустимые значения и примеры доступны в Playground справа — все поля enum поддерживают выбор из выпадающего списка.

Формат ответа

⚠️ b64_json is raw base64, без data:image/...;base64, префикса. Клиент должен:
  • Записать файл: base64.b64decode(b64_str) → записать на диск
  • Отрисовка в браузере: добавьте data:image/png;base64, вручную
По состоянию на июль 2026 года, gpt-image-2-all / gpt-image-2-vip тоже возвращают raw base64, но их ранние версии включали префикс — при использовании кода для разных моделей всегда сначала проверяйте startsWith('data:').
Поле usage отражает фактическое число тарифицируемых tokens для этого вызова. input_tokens_details / output_tokens_details отдельно разбивают tokens текста и изображения (image_tokens всегда равно 0 для обычного text-to-image). Полное описание поля и формулу самостоятельного расчета стоимости см. в разделе Как проверить реальное число tokens для каждого вызова на обзорной странице.

Авторизации

Authorization
string
header
обязательно

API Key obtained from APIYI Console

Тело

application/json
model
enum<string>
по умолчанию:gpt-image-2
обязательно

Model name, fixed as gpt-image-2

Доступные опции:
gpt-image-2
prompt
string
обязательно

Prompt text. Supports both Chinese and English. Place scene description at the front for better adherence.

Пример:

"Cyberpunk city at night, neon sign closeup, cinematic frame"

size
string
по умолчанию:auto

Output size. Presets: 1024x1024 / 1536x1024 / 1024x1536 / 2048x2048 / 2048x1152 / 3840x2160 / 2160x3840. Also accepts any valid custom size (max edge ≤ 3840, both multiples of 16, ratio ≤ 3:1, total pixels 0.65–8.3MP).

Пример:

"2048x1152"

quality
enum<string>
по умолчанию:auto

Quality tier. low (sketches/batch), medium (daily), high (final/fine text), auto (default)

Доступные опции:
auto,
low,
medium,
high
output_format
enum<string>
по умолчанию:png

Output format

Доступные опции:
png,
jpeg,
webp
output_compression
integer

Output compression (0–100), only effective for jpeg/webp

Требуемый диапазон: 0 <= x <= 100
Пример:

85

background
enum<string>
по умолчанию:auto

Background mode. auto (default) or opaque. Not supported: transparent

Доступные опции:
auto,
opaque
moderation
enum<string>
по умолчанию:auto

Moderation strength. auto (default) or low

Доступные опции:
auto,
low
n
enum<integer>
по умолчанию:1

Number of images. This model only supports 1

Доступные опции:
1

Ответ

Image generated successfully

created
integer

Unix timestamp

Пример:

1776832476

data
object[]

Generation results (this model returns 1 image per call)

usage
object

Token usage for this call (used for token-based billing)