Обзор
Grok Imagine 2 — это новейшая модель второго поколения от xAI для изображений, представляющая собой полноценный шаг вперёд по сравнению с первым релизом как в управлении параметрами, так и в редактировании: соотношение сторон и разрешение действительно применяются, доступен уровень 2K, один вызов возвращает до 10 изображений, а редактирование по референсу действительно сохраняет исходное изображение. APIYI предлагает два варианта:grok-imagine-image (стандартный) и grok-imagine-image-quality (высокое качество). Оба используют одинаковые эндпоинты и параметры — они различаются только точностью результата и ценой.
2. Продукт называется Grok Imagine 2, но имена моделей, которые вы вызываете, — grok-imagine-image и grok-imagine-image-quality — не указывайте grok-imagine-2-image, так как это возвращает 503: такой модели не существует.API преобразования текста в изображение
API редактирования изображений
Поручите интеграцию AI-агенту
.md к любому docs URL), затем напишет код в стеке вашего проекта — таймаут, немедленное повторное размещение результатов по URL, эндпоинт, который молча отбрасывает reference images, но всё равно тарифицирует вас, и тот факт, что size ничего не делает, уже заложены в требования.Поручите кодирующему агенту интеграцию или устранение неполадок Grok Imagine 2 для генерации изображений по тексту и редактирования изображений. Скопируйте и вставьте это в Codex, Claude Code, Cursor и аналогичные инструменты.
От чего вас защищает этот промпт
От чего вас защищает этот промпт
Почему Grok Imagine 2 на APIYI
Формат, совместимый с OpenAI
/v1/images/generations и /v1/images/edits эндпоинты. Тела запросов и поля ответов совпадают с OpenAI Images API, поэтому официальный OpenAI SDK работает напрямую — без усилий по миграции.Без ограничений на параллельные запросы
Фиксированная цена, предсказуемая стоимость
Глобальный доступ без барьеров
api.apiyi.com.Полная экосистема моделей
Профессиональная поддержка
Ключевые особенности
Два уровня разрешения
1k около 1 мегапикселя, 2k 4.2-4.5 мегапикселей (2816x1584 при 16:9) — та же цена, так что 2K выгоднее5 соотношений сторон
1:1 / 16:9 / 9:16 / 4:3 / 3:4, при этом измеренные размеры в пикселях совпадают точноДо 10 за один вызов
n принимает 1-10, возвращая несколько изображений за один запрос — идеально для пакетного отбораБыстрая генерация
Настоящее редактирование по референсу
Слияние нескольких изображений
Два формата ответа
url прямые ссылки или b64_json необработанный base64, поддерживаются на обоих эндпоинтахOpenAI SDK готов к работе
client.images.generate() и client.images.edit() работают из коробки — без ручной настройки HTTPЦены
- Мы игнорируем разрешение; xAI — нет. У xAI уровень качества указан по $0.05 для 1K и $0.07 для 2K, тогда как APIYI взимает фиксированные $0.045 — поэтому чем выше разрешение, тем больше экономия, достигающая примерно 64% от прайс-листа на 2K.
- За изображение:
n=4тарифицируется как 4 изображения, независимо от длины prompt. - Редактирование стоит столько же, сколько и text-to-image — для
/v1/images/editsне предусмотрена наценка. - Блок
usageнельзя использовать для сверки:prompt_tokensвсегда1000 x n, это заполнитель. Вместо этого используйте записи тарификации в консоли.
Эффективная стоимость с бонусами за пополнение
Эти скидки суммируются с многоуровневым бонусом за пополнение (рассчитывается для каждого отдельного пополнения, а не суммарно). Если брать уровень качества 2K:Настройка группы
Почему используется отдельная группа: политика безопасности контента этого семейства существенно отличается от политик других моделей на платформе, а некоторые категории не фильтруются. Чтобы снизить риски, связанные с соблюдением требований, мы не включаем его в группу по умолчанию, доступную каждой учётной записи, и предоставляем доступ выборочно.Кто может получить доступ
Как подать заявку
Свяжитесь с поддержкой WeCom
Опишите сценарий использования и средства модерации
Переключите свой Token на эту группу
Grok_imagine для вашей учётной записи. Перейдите на страницу Token в консоли и переключите Token, который используется для этого семейства, на Grok_imagine, установив модель тарификации Pay-as-you-go Priority или Pay-per-request.Grok_imagine возвращает 503 (в текущей группе нет доступного канала). Повторные попытки не помогут — сначала необходимо включить группу.Рекомендуемая модель тарификации Token: Pay-as-you-go Priority. Это семейство тарифицируется за каждый запрос, и маршрутизация работает корректно как для тарификации с приоритетом по мере использования, так и для оплаты за запрос — выбор тарификации с приоритетом по мере использования позволяет одному Token также обслуживать модели с тарификацией за token в других разделах платформы.Технические характеристики
Эндпоинты
Миграция с GPT-Image-2
Если вы уже интегрировали GPT-Image-2, эндпоинты и соглашение о вызовах идентичны (/v1/images/generations + /v1/images/edits, совместимо с OpenAI SDK), однако система параметров отличается, поэтому простая замена имени модели не сработает. Ниже описано, что необходимо изменить.
Сопоставление параметров
В таблице GPT-Image-2 используется в качестве основы;gpt-image-2.5-flare / gpt-image-2.5-sunburst используют те же параметры, поэтому сопоставление применимо и к ним.
Три самые распространённые ошибки
До и после
Ключевые параметры
aspect_ratio и resolution (размер вывода)
Вместе они определяют фактическое количество пикселей вывода. Измеренные значения точно соответствуют запросу:
aspect_ratio (например, 5:7, 21:9) или resolution (например, 1K, 1024x1024) молча откатываются к значению по умолчанию и всё равно возвращают image. Неверный response_format аналогично откатывается к url. Поэтому, если результат не соответствует ожиданиям, сначала проверьте написание параметров.Единственное исключение — resolution: "4k", который возвращает 503 model_service_unavailable. Это означает, что уровень не поддерживается, а не что канал недоступен — переключитесь обратно на 1k / 2k.n (изображений за вызов)
Принимает 1-10; длина возвращаемого массива data равна n, и каждое image тарифицируется. 0 молча интерпретируется как 1; 11 или выше возвращает 400.
Лучшие практики
Сразу решите: генерация или редактирование?
/v1/images/generations. Любое опорное изображение, даже для изменения на один пиксель → /v1/images/edits. Если выбрать неверный эндпоинт, ошибки не будет — только неожиданное изображение.Установите тайм-аут клиента на 360 секунд
Контролируйте композицию с помощью aspect_ratio, а не prompt
aspect_ratio: "16:9" гораздо надёжнее, чем просить в prompt «пейзажную композицию».Выбирайте уровень разрешения с учётом пропускной способности
Говорите «оставьте всё остальное без изменений» при редактировании
Явно указывайте изображения при объединении
image[] — это то, что означает «изображение 1 / изображение 2 / изображение 3». Формулировка «поместите объект из изображения 1 в сцену из изображения 2» гораздо надёжнее, чем позволять модели угадывать.Не полагайтесь на seed для воспроизводимости
seed; один и тот же prompt даёт разные результаты при разных вызовах. Сохраняйте изображения, которые хотите оставить, вместо того чтобы ожидать их повторной генерации.Просто используйте параллельную обработку для пакетных задач
Коды ошибок и повторные попытки
400 и 415 являются детерминированными — повторять запрос бессмысленно, поэтому вместо этого отправьте оповещение. Повторять стоит только 429 и тайм-ауты на уровне сети, используя экспоненциальную задержку и не более 3 попыток.Обратите внимание, что 400 invalid_request охватывает как «недопустимый параметр», так и «контент заблокирован», и тело ответа не позволяет их различить. Практический ориентир — задержка: блокировки модерацией возвращаются примерно через 5–6 секунд, то есть быстрее успешной генерации (около 9 с), поскольку блокировка происходит до начала генерации.Часто задаваемые вопросы
Каждый вызов возвращает 503 — канал недоступен? Как получить доступ?
Каждый вызов возвращает 503 — канал недоступен? Как получить доступ?
resolution: "4k" означает, что этот уровень не поддерживается (см. запись ниже). Если параметры корректны, а 503 возникает постоянно, почти наверняка у токена отсутствует группа Grok_imagine.Это семейство по умолчанию недоступно: его политика безопасности контента существенно отличается от политик других моделей на платформе, а некоторые категории не фильтруются, поэтому для снижения рисков, связанных с соблюдением требований, мы помещаем его в отдельную группу Grok_imagine и предоставляем доступ выборочно. Существующие клиенты с совокупными расходами от $1.000 могут включить эту возможность, описав сценарий использования службе поддержки; все остальные подают заявку через поддержку WeCom, указав сценарий использования и действующие средства модерации контента.Полный процесс описан выше в разделе Настройка группы.Почему отправка JSON в /v1/images/edits возвращает 400, если в документации поставщика указан JSON?
Почему отправка JSON в /v1/images/edits возвращает 400, если в документации поставщика указан JSON?
multipart/form-data, тогда как в документации поставщика upstream описано тело JSON с общедоступным URL изображения. Эти варианты отличаются — следуйте документации этого сайта.Правильный формат — загрузка файла:Я отправил эталонное изображение в text-to-image и получил 200, но результат не имеет к нему отношения?
Я отправил эталонное изображение в text-to-image и получил 200, но результат не имеет к нему отношения?
/v1/images/generations молча игнорирует image / image_url / images, генерирует изображение только по промпту и обычным образом списывает оплату.При отсутствии сигнала об ошибке легко решить, что «редактирование не работает». Любой рабочий процесс с эталонным изображением должен использовать /v1/images/edits.Почему resolution / aspect_ratio не влияют на эндпоинт редактирования?
Почему resolution / aspect_ratio не влияют на эндпоинт редактирования?
resolution или aspect_ratio здесь не вызывает ошибку, но ничего не меняет.Чтобы изменить размер результата, обрежьте или измените размер эталонного изображения перед загрузкой.Почему в ответе отсутствует revised_prompt?
Почему в ответе отсутствует revised_prompt?
revised_prompt, а также такие поля, как respect_moderation или model. Каждая запись data[] содержит либо url, либо b64_json в зависимости от response_format — никогда оба поля одновременно.Не предполагайте наличие этих полей при разборе ответов.Можно ли сверить тарификацию по количеству токенов в usage?
Можно ли сверить тарификацию по количеству токенов в usage?
usage.prompt_tokens всегда имеет значение 1000 x n независимо от фактической длины промпта — это заполнитель.Для этого семейства тарификация выполняется за запрос по фиксированной ставке за изображение. Для проверки фактических списаний используйте записи тарификации в консоли APIYI.Почему 1K возвращает JPEG, а 2K — PNG? Размеры сильно отличаются
Почему 1K возвращает JPEG, а 2K — PNG? Размеры сильно отличаются
resolution: 1k возвращает JPEG (примерно 220–300 КБ), а resolution: 2k — PNG без потерь (примерно 5–6 МБ), то есть разница составляет около 20 раз.Расширение URL, HTTP Content-Type и фактические байты согласованы между собой, поэтому вы можете безопасно выбирать ветку обработки по Content-Type.В сценариях, чувствительных к пропускной способности (мобильные устройства, массовая передача), предпочитайте 1k — оба уровня стоят одинаково, поэтому решение зависит исключительно от качества. Если же требуется качество, 2k не предусматривает доплаты и предоставляется со значительно большей скидкой относительно стандартной цены.resolution: 4k возвращает 503 — канал недоступен?
resolution: 4k возвращает 503 — канал недоступен?
4k не является поддерживаемым уровнем для этого семейства, поэтому шлюз возвращает 503 model_service_unavailable. Код выглядит как признак сбоя, но на самом деле указывает на проблему с параметром, поэтому повторная попытка не поможет — переключитесь обратно на 1k или 2k.Поддерживаются только 1k и 2k.Почему недопустимые параметры приводят к созданию неправильного изображения, а не к ошибке?
Почему недопустимые параметры приводят к созданию неправильного изображения, а не к ошибке?
aspect_ratio (например, 5:7), resolution (например, 1K, 1024x1024) и response_format (например, base64) молча заменяются значениями по умолчанию, после чего возвращается изображение, а не ошибка 400.Поэтому, если результат не соответствует ожиданиям, сначала проверьте написание параметров — особенно значения resolution: они должны быть в нижнем регистре 1k / 2k.Сколько изображений может создать один вызов?
Сколько изображений может создать один вызов?
n принимает значения от 1 до 10, а длина возвращаемого массива data равна n. За каждое изображение взимается плата.0 автоматически заменяется на 1; значение 11 или выше возвращает 400 invalid_request.Поддерживается ли воспроизводимость на основе seed?
Поддерживается ли воспроизводимость на основе seed?
seed не вызывает ошибку, но не влияет на результат — один и тот же промпт с одинаковым seed возвращает разные изображения при разных вызовах.Сохраняйте изображения, которые нужно использовать повторно, вместо попыток сгенерировать их заново.Можно ли вызывать это через официальный OpenAI SDK?
Можно ли вызывать это через официальный OpenAI SDK?
base_url значение https://api.apiyi.com/v1:aspect_ratio и resolution не являются стандартными полями OpenAI SDK, поэтому передавайте их через extra_body.Есть ли ограничения на параллельные запросы? Будет ли генерация пакетами ограничиваться?
Есть ли ограничения на параллельные запросы? Будет ли генерация пакетами ограничиваться?
timeout: API изображений работают синхронно, поэтому установите тайм-аут клиента 360 секунд, чтобы не прерывать запросы, которые всё ещё нормально обрабатываются и за которые по-прежнему взимается плата.Как работает модерация контента и как определить блокировку?
Как работает модерация контента и как определить блокировку?
400 invalid_request, используя в точности тот же код и сообщение об ошибке, что и при ошибке параметра, поэтому по телу ответа отличить эти случаи невозможно.Практический ориентир — время задержки: блокировки модерацией возвращаются примерно через 5–6 секунд (блокировка происходит до генерации), тогда как успешная генерация изображения занимает около 9 секунд. Результаты модерации также частично случайны, поэтому пограничный контент может вести себя по-разному при повторных попытках — не делайте выводы по одной попытке.Если параметры проверены, но ошибки 400 сохраняются, скорее всего, промпт вызвал срабатывание модерации; измените формулировку.Можно ли генерировать изображения через /v1/chat/completions?
Можно ли генерировать изображения через /v1/chat/completions?
content представляет собой ссылку на изображение в Markdown:/v1/images/generations и /v1/images/edits) — он поддерживает более丰富ные параметры, имеет более стабильную структуру ответа и соответствует этой документации.Связанная документация
- Grok Imagine 2 Текст-в-изображение API - справочник по эндпоинту с Playground
- Grok Imagine 2 Редактирование изображений API - справочник по редактированию и объединению нескольких изображений
- Руководство по модели Grok - текстовые модели xAI
- Лучшие практики Image API - тайм-ауты, разрывы соединения, сжатие
- Руководство по API
- Акции на пополнение