> ## Documentation Index
> Fetch the complete documentation index at: https://docs.apiyi.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Каковы лимиты параллельных запросов API?

> Узнайте о лимитах параллельных запросов для разных типов моделей и о том, как запросить более высокие квоты

## Краткий ответ

**Лимиты параллельных запросов зависят от типа модели** - у текстовых моделей самый высокий уровень параллельных запросов, а у моделей для генерации изображений - умеренные ограничения.

<Info>
  **Важное примечание**

  Лимиты параллельных запросов применяются к **отдельным моделям**, а не ко всему вашему аккаунту. Например, Nano Banana Pro поддерживает 30 параллельных запросов, что не влияет на параллельные запросы других моделей.
</Info>

## Лимиты параллельных запросов по типу модели

<CardGroup cols={3}>
  <Card title="Текстовые модели" icon="file-text">
    **По умолчанию: 50 req/sec**

    * ✅ Поддержка высокой параллельности
    * ✅ Подходит для пакетной обработки
    * 🔓 Более высокие квоты доступны
  </Card>

  <Card title="Асинхронные видео-модели" icon="video">
    **По умолчанию: высокая параллельность**

    * ✅ Асинхронная обработка
    * ✅ Поддержка крупных объемов вызовов
    * 📊 Идеально подходит для пакетной генерации видео
  </Card>

  <Card title="Модели изображений" icon="image">
    **По умолчанию: 30 req/sec**

    * ⚠️ Параллельные запросы контролируются
    * 📦 Передача больших данных Base64
    * 🔓 Настраивается по запросу
  </Card>
</CardGroup>

## Почему у моделей изображений есть контроль параллельных запросов?

<Warning>
  **Техническая причина**

  API для генерации изображений используют кодирование **Base64** для передачи данных изображений, что приводит к большим полезным нагрузкам запроса (обычно 500KB-5MB на запрос). Чтобы обеспечить стабильность сервиса и скорость ответа, необходим умеренный контроль параллельных запросов.

  **Пример**: У Nano Banana Pro по умолчанию 30 параллельных запросов, что достаточно для большинства сценариев использования.
</Warning>

## Как рассчитываются параллельные запросы

### Для каждой отдельной модели

Лимиты параллельных запросов применяются к **каждой конкретной модели**, а не ко всей вашей учетной записи:

| Сценарий                     | Расчет параллельных запросов                                   |
| ---------------------------- | -------------------------------------------------------------- |
| Вызовы одной и той же модели | Подчиняются лимиту этой модели (например, Nano Banana Pro: 30) |
| Вызовы разных моделей        | Каждая модель рассчитывается независимо                        |
| Несколько token              | У каждого token своя независимая параллельность                |

<Tip>
  **Реальный пример**

  Если одновременно использовать:

  * Nano Banana Pro (image): 30 одновременно
  * GPT-4o mini (text): 50 одновременно
  * FLUX.1 Pro (image): 30 одновременно

  **Общая доступная параллельность**: 110+ запросов (независимо по каждой модели)
</Tip>

## Как запросить более высокие параллельные запросы?

### Индивидуальные пользователи

<Steps>
  <Step title="Оцените свои потребности">
    Определите требуемый уровень параллельных запросов и сценарий использования
  </Step>

  <Step title="Свяжитесь со службой поддержки">
    [Свяжитесь с нами в Enterprise WeChat](https://work.weixin.qq.com/kfid/kfc9adfd5810ece25ec), чтобы описать свои потребности
  </Step>

  <Step title="Техническая проверка">
    Мы оценим запрос на основе вашего сценария использования и исторических данных
  </Step>

  <Step title="Корректировка квоты">
    После одобрения мы скорректируем лимиты параллельных запросов для вашего token
  </Step>
</Steps>

### Корпоративные клиенты

<Info>
  **Сервис выделенной линии**

  Корпоративные клиенты могут подать заявку на услуги выделенной линии со следующими преимуществами:

  * 🚀 **Более высокие квоты на параллельные запросы**: Настраиваются под потребности бизнеса
  * 🔒 **Изолированные пулы ресурсов**: Не зависят от публичного трафика
  * ⚡ **Приоритетное планирование**: Гарантированная скорость ответа
  * 📞 **Персональное обслуживание**: Обслуживание один на один

  Свяжитесь с нами, чтобы узнать о планах корпоративного обслуживания.
</Info>

## Часто задаваемые вопросы

<AccordionGroup>
  <Accordion title="Почему у текстовых моделей выше лимит параллельных запросов, чем у моделей для изображений?">
    Текстовые модели передают меньший объем данных запроса/ответа (обычно несколько КБ), тогда как модели для изображений передают данные изображений в Base64 (обычно 500KB-5MB). Управление параллельными запросами обеспечивает общее качество сервиса.
  </Accordion>

  <Accordion title="Как проверить текущую квоту на параллельные запросы?">
    Вы можете проверить это через:

    * Конфигурацию token в консоли бэкенда
    * Информацию о лимите запросов в заголовках ответа API
    * Обратиться в службу поддержки для уточнения конкретных квот
  </Accordion>

  <Accordion title="Что произойдет, если я превышу лимиты параллельных запросов?">
    При превышении лимитов API возвращает `429 Too Many Requests`. Рекомендации:

    * Реализуйте управление очередью запросов
    * Добавьте механизм повторных попыток (экспоненциальная задержка)
    * Подайте заявку на более высокую квоту параллельных запросов
  </Accordion>

  <Accordion title="Разделяются ли лимиты параллельных запросов между разными token?">
    Нет. У каждого token есть независимые квоты на параллельные запросы без взаимного влияния. Для большей общей параллельности запросов создайте несколько token, чтобы распределить запросы.
  </Accordion>

  <Accordion title="Есть ли дополнительная плата за изменение квот на параллельные запросы?">
    Как правило, разумные изменения параллельных запросов предоставляются **бесплатно**. Однако очень высокая параллельность или услуги выделенной линии могут потребовать корпоративных индивидуальных планов - пожалуйста, обратитесь в службу поддержки для подробностей.
  </Accordion>
</AccordionGroup>

## Советы по оптимизации параллельных запросов

<CardGroup cols={2}>
  <Card title="Используйте очереди запросов" icon="list">
    Реализуйте локальное управление очередью, чтобы контролировать одновременные запросы и избегать лимитов
  </Card>

  <Card title="Механизм повторных попыток при ошибках" icon="rotate">
    Используйте стратегию повторных попыток с экспоненциальной задержкой при возникновении ошибок 429
  </Card>

  <Card title="Распределение по нескольким token" icon="key">
    Создайте несколько token, чтобы распределять запросы между разными token и увеличивать общую параллельность
  </Card>

  <Card title="Отдавайте приоритет асинхронной обработке" icon="clock">
    Для сценариев без работы в реальном времени предпочитайте async API (например, для генерации видео)
  </Card>
</CardGroup>

## Свяжитесь с нами

Чтобы запросить более высокие квоты на параллельные запросы или узнать о корпоративных услугах выделенной линии:

<CardGroup cols={3}>
  <Card title="Поддержка по email" icon="mail">
    [feedback@apiyi.com](mailto:feedback@apiyi.com)

    Подробно опишите ваши потребности в параллельных запросах
  </Card>

  <Card title="Корпоративный WeChat" icon="message-circle" href="https://work.weixin.qq.com/kfid/kfc9adfd5810ece25ec">
    <img src="https://mintcdn.com/apiyillc/fpi567ydpk7adDt0/images/wecom-qrcode.png?fit=max&auto=format&n=fpi567ydpk7adDt0&q=85&s=7286b96e94110e3a48798b649df1b45b" alt="QR-код корпоративного WeChat" style={{maxWidth: "180px"}} width="400" height="400" data-path="images/wecom-qrcode.png" />

    Сканируйте QR-код или [Нажмите, чтобы связаться с поддержкой](https://work.weixin.qq.com/kfid/kfc9adfd5810ece25ec)

    Быстрый ответ, общение в реальном времени
  </Card>

  <Card title="Telegram" icon="send">
    @apiyi001

    Мгновенные сообщения, оперативные ответы
  </Card>
</CardGroup>

<Tip>
  **Пожалуйста, укажите при обращении**:

  * 📊 **Сценарий использования**: Конкретное применение (например, пакетная генерация изображений для e-commerce, модерация контента)
  * 📈 **Ожидаемая параллельность**: Требуемый уровень параллельных запросов
  * 🕐 **Пиковые часы**: Основные периоды использования
  * 📜 **Исторические данные**: Текущий объем запросов и частота

  Эта информация поможет нам подобрать для вас наиболее подходящий план квоты на параллельные запросы.
</Tip>
