> ## Documentation Index
> Fetch the complete documentation index at: https://docs.apiyi.com/llms.txt
> Use this file to discover all available pages before exploring further.

# В чем разница между режимами тарификации token?

> Подробное объяснение 5 режимов тарификации token в API.YI, сценариев использования и лучших практик

## Краткий ответ

<Info>
  **Рекомендуемая настройка**: При создании token выберите режим тарификации **"Pay-per-Use Priority"**, который подходит для большинства сценариев.
</Info>

Хотя система предоставляет 5 типов тарификации, использование **"Pay-per-Use Priority" по умолчанию** покрывает все сценарии вызова моделей.

<img className="block dark:hidden" src="https://mintcdn.com/apiyillc/Cic_8J3gmaYuqnbs/images/token-billing-modes.png?fit=max&auto=format&n=Cic_8J3gmaYuqnbs&q=85&s=0648c415db25659d45c57f46fab8ceb2" alt="Выбор режима тарификации для token" width="1272" height="888" data-path="images/token-billing-modes.png" />

<img className="hidden dark:block" src="https://mintcdn.com/apiyillc/Cic_8J3gmaYuqnbs/images/token-billing-modes.png?fit=max&auto=format&n=Cic_8J3gmaYuqnbs&q=85&s=0648c415db25659d45c57f46fab8ceb2" alt="Выбор режима тарификации для token" width="1272" height="888" data-path="images/token-billing-modes.png" />

## 5 Объяснение режимов тарификации

### 1. Оплата по использованию (на основе Tokens)

**Определение**: Тарификация на основе количества **Tokens** для входных и выходных данных; вы платите только за то, что используете.

**Применимые модели**:

* **Модели генерации текста**: GPT-4, Claude, Gemini, DeepSeek и т. д.
* **Модели мультимодального понимания**: модели, поддерживающие ввод изображений/аудио
* **Специальные модели изображений**: `gpt-image-1` (тарифицируются по Tokens)

**Формула тарификации**:

```
Total Cost = (Input Tokens × Input Price) + (Output Tokens × Output Price)
```

**Примеры**:

* `gpt-4o`: Вход \$5/миллион tokens, Выход \$15/миллион tokens
* `claude-3-5-sonnet-20241022`: Вход \$3/миллион tokens, Выход \$15/миллион tokens

<Tip>
  **Особое примечание по gpt-image-1**: Хотя это модель генерации изображений, она тарифицируется по Tokens. На Tokens влияют следующие факторы:

  * Разрешение изображения (1024x1024, 1792x1024 и т. д.)
  * Качество изображения (standard, hd)

  OpenAI предоставляет подробную таблицу тарификации с различным расходом Tokens для разных разрешений и качеств.
</Tip>

***

### 2. Оплата за вызов

**Определение**: **Фиксированная плата** за каждый вызов, не зависящая от входных и выходных Tokens.

**Применимые модели**:

* **Модели генерации изображений**: DALL-E, Flux, Sora Image и т. д. (кроме gpt-image-1)
* **Модели генерации видео**: Sora Video, VEO и т. д.

**Формула тарификации**:

```
Total Cost = Number of Calls × Price per Call
```

**Примеры**:

* `gemini-3-pro-image-preview` (псевдоним `nano-banana-pro`): \$0.09/вызов
* `sora_video2`: \$0.15/вызов (10-секундное видео)
* `flux-1.1-pro`: \$0.04/вызов

<Note>
  **Преимущества оплаты за вызов**:

  * Прозрачная тарификация, фиксированная стоимость за одну генерацию
  * Не нужно рассчитывать расход Tokens
  * Подходит для сценариев с фиксированным результатом, например изображений/видео
</Note>

***

### 3. Гибридная тарификация

**Определение**: Поддерживает как оплату по использованию, так и оплату за вызов; автоматически выбирается в зависимости от модели.

**Статус**: ⚠️ **Не применимо**

<Warning>
  В настоящее время платформа API.YI **не рекомендует использовать режим «Гибридная тарификация»**, поскольку это может вызвать путаницу в тарификации. Вместо этого используйте «Приоритет оплаты по использованию».
</Warning>

***

### 4. Приоритет оплаты по использованию (рекомендуется)

**Определение**: **Умный режим тарификации**, который **в первую очередь использует оплату по использованию**, если модель поддерживает оба варианта; автоматически переключается на оплату за вызов, если модель поддерживает только ее.

**Почему рекомендуется?**

* ✅ **Включает оплату за вызов**: можно вызывать модели изображений/видео, тарифицируемые за вызов
* ✅ **Включает оплату по использованию**: можно вызывать текстовые/мультимодальные модели, тарифицируемые по использованию
* ✅ **Автоматическая адаптация**: система автоматически выбирает наиболее подходящий способ тарификации
* ✅ **Покрывает все сценарии**: поддерживаются все 400+ моделей

**Логика тарификации**:

```
If model supports pay-per-use → Use pay-per-use billing
If model only supports pay-per-call → Use pay-per-call billing
```

**Примеры сценариев**:

| Модель                       | Способ тарификации      | Описание                                                           |
| ---------------------------- | ----------------------- | ------------------------------------------------------------------ |
| `gpt-4o`                     | Оплата по использованию | Текстовая модель, приоритет — оплата по использованию              |
| `gpt-image-1`                | Оплата по использованию | Модель изображений, но тарифицируется по Tokens                    |
| `gemini-3-pro-image-preview` | Оплата за вызов         | Модель изображений, автоматическое переключение на оплату за вызов |
| `sora_video2`                | Оплата за вызов         | Модель видео, автоматическое переключение на оплату за вызов       |

<Info>
  **Причина рекомендации**: Использование token «Приоритет оплаты по использованию» позволяет вызывать все модели без создания отдельных token для разных режимов тарификации.
</Info>

***

### 5. Приоритет оплаты за вызов

**Определение**: **В первую очередь использует оплату за вызов**, если модель поддерживает оба варианта; автоматически переключается на оплату по использованию, если модель поддерживает только ее.

**Применимые сценарии**:

* Сценарии, требующие фиксированных затрат
* В основном при использовании моделей генерации изображений/видео

**Логика тарификации**:

```
If model supports pay-per-call → Use pay-per-call billing
If model only supports pay-per-use → Use pay-per-use billing
```

<Note>
  **Рекомендация по использованию**: Если нет явного требования к контролю затрат, используйте «Приоритет оплаты по использованию», так как текстовые модели обычно более экономичны при оплате по использованию.
</Note>

***

## Как выбрать режим тарификации?

### Рекомендуемое решение (подходит для 95％ пользователей)

<Card title="Приоритет оплаты по использованию (рекомендуется по умолчанию)" icon="star">
  **Сценарии применения**:

  * Одновременное использование text, image и video моделей
  * Не нужно создавать разные token для разных моделей
  * Нужна максимальная гибкость

  **Преимущества**:

  * Поддерживает все 400+ моделей
  * Система автоматически выбирает оптимальный способ тарификации
  * Не требуется дополнительная настройка
</Card>

### Особые сценарии

<Tabs>
  <Tab title="Только текстовое приложение">
    **Сценарий**: Используются только GPT, Claude, Gemini и другие text модели

    **Рекомендуемый режим тарификации**: Приоритет оплаты по использованию или Оплата по использованию

    **Причина**: Все text модели используют тарификацию по использованию, оба режима дают одинаковый результат
  </Tab>

  <Tab title="Только приложение для image/video">
    **Сценарий**: Используются только DALL-E, Flux, Sora и другие модели генерации

    **Рекомендуемый режим тарификации**: Приоритет оплаты по использованию или Приоритет оплаты за вызов

    **Причина**: Большинство image/video моделей используют тарификацию за вызов, но "Приоритет оплаты по использованию" может автоматически адаптироваться

    **Примечание**: Если используется `gpt-image-1`, необходимо использовать "Приоритет оплаты по использованию" или "Оплата по использованию"
  </Tab>

  <Tab title="Контроль затрат">
    **Сценарий**: Строгий контроль бюджета, нужна фиксированная стоимость за вызов

    **Рекомендуемый режим тарификации**: Оплата за вызов или Приоритет оплаты за вызов

    **Причина**: Тарификация за вызов имеет фиксированные цены, что удобно для прогнозирования затрат

    **Ограничение**: Нельзя вызывать text модели (например, GPT-4, Claude)
  </Tab>
</Tabs>

## Вопросы и ответы

<AccordionGroup>
  <Accordion title="Почему для gpt-image-1 требуется токен с оплатой по использованию?">
    `gpt-image-1` — это официальная модель генерации изображений OpenAI. Хотя она генерирует изображения, метод тарификации у нее похож на текстовые модели, **оплата взимается по token**.

    **Факторы тарификации**:

    * Разрешение изображения (1024x1024 расходует около \~5000 token, 1792x1024 расходует около \~8500 token)
    * Качество изображения (качество HD увеличивает потребление token)

    **Решение**:

    * Используйте token «Приоритет оплаты по использованию» или «Оплата по использованию»
    * Использование token «Оплата за вызов» не позволит вызывать `gpt-image-1`
  </Accordion>

  <Accordion title="Я уже создал token с оплатой за вызов, можно ли изменить его на приоритет оплаты по использованию?">
    **Да, вы можете изменить его**. Шаги:

    1. Войдите на [страницу управления token API.YI](https://api.apiyi.com/token)
    2. Найдите соответствующий token и нажмите кнопку «Редактировать» справа
    3. Выберите «Приоритет оплаты по использованию» в раскрывающемся списке «Режим тарификации»
    4. Сохраните конфигурацию

    **Примечание**: изменения вступают в силу немедленно и не влияют на существующий баланс.
  </Accordion>

  <Accordion title="В чем разница между приоритетом оплаты по использованию и приоритетом оплаты за вызов?">
    **Разные приоритеты**:

    | Режим тарификации                 | Когда модель поддерживает и оплату по использованию, и оплату за вызов | Применимые сценарии                                   |
    | --------------------------------- | ---------------------------------------------------------------------- | ----------------------------------------------------- |
    | Приоритет оплаты по использованию | Приоритет у тарификации по использованию                               | В основном текстовые модели, иногда изображения/видео |
    | Приоритет оплаты за вызов         | Приоритет у тарификации за вызов                                       | В основном изображения/видео, иногда текстовые модели |

    **Рекомендация**: в большинстве случаев используйте «Приоритет оплаты по использованию».
  </Accordion>

  <Accordion title="Если я выберу неправильный режим тарификации, вызов завершится неудачей?">
    **Сразу не завершится неудачей, но вы можете не суметь вызвать некоторые модели**.

    **Примеры сценариев**:

    * Если token имеет режим «Оплата за вызов», вызов `gpt-4o` завершится неудачей (потому что gpt-4o поддерживает только тарификацию по использованию)
    * Если token имеет режим «Оплата по использованию», вызов `gemini-3-pro-image-preview` может завершиться неудачей (потому что эта модель поддерживает только тарификацию за вызов)

    **Решение**: используйте «Приоритет оплаты по использованию», чтобы избежать этой проблемы.
  </Accordion>

  <Accordion title="Почему гибридная тарификация не применяется?">
    **Гибридная тарификация** теоретически поддерживает и оплату по использованию, и оплату за вызов, но на практике может привести к:

    * Неясной логике тарификации
    * Сложностям с прогнозированием затрат
    * Проблемам совместимости системы

    **Альтернатива**: используйте «Приоритет оплаты по использованию», чтобы добиться того же эффекта с большей стабильностью и надежностью.
  </Accordion>
</AccordionGroup>

***

## Рекомендации по выбору режима тарификации

| Режим тарификации                        | Рекомендация | Применимые сценарии                                    | Охват моделей                                    |
| ---------------------------------------- | ------------ | ------------------------------------------------------ | ------------------------------------------------ |
| **Приоритетная оплата за использование** | ⭐⭐⭐⭐⭐        | Все сценарии (рекомендуется по умолчанию)              | Все 400+ моделей                                 |
| Оплата за использование                  | ⭐⭐⭐          | Приложения только с текстом/мультимодальные приложения | Текстовые модели + gpt-image-1                   |
| Оплата за вызов                          | ⭐⭐⭐          | Приложения только для изображений/видео                | Модели для изображений/видео (кроме gpt-image-1) |
| Приоритетная оплата за вызов             | ⭐⭐           | В основном использование изображений/видео             | Все 400+ моделей                                 |
| Гибридная тарификация                    | ❌            | Не рекомендуется                                       | Может привести к путанице в тарификации          |

<Info>
  **Лучшая практика**: при создании token выбирайте режим тарификации "**Приоритетная оплата за использование**", чтобы покрыть все сценарии использования без создания разных token для разных моделей.
</Info>

## Связанная документация

* [Как создать KEY?](/ru/faq/token-management)
* [Нужно ли задавать доступные модели для tokens?](/ru/faq/token-model-whitelist)
* [Тарифы](/ru/pricing)
* [Список моделей](/ru/api-capabilities/model-info)
