Краткий ответ
Рекомендуемая настройка: При создании token выберите режим тарификации “Pay-per-Use Priority”, который подходит для большинства сценариев.

5 Объяснение режимов тарификации
1. Оплата по использованию (на основе Tokens)
Определение: Тарификация на основе количества Tokens для входных и выходных данных; вы платите только за то, что используете. Применимые модели:- Модели генерации текста: GPT-4, Claude, Gemini, DeepSeek и т. д.
- Модели мультимодального понимания: модели, поддерживающие ввод изображений/аудио
- Специальные модели изображений:
gpt-image-1(тарифицируются по Tokens)
gpt-4o: Вход $5/миллион tokens, Выход $15/миллион tokensclaude-3-5-sonnet-20241022: Вход $3/миллион tokens, Выход $15/миллион tokens
2. Оплата за вызов
Определение: Фиксированная плата за каждый вызов, не зависящая от входных и выходных Tokens. Применимые модели:- Модели генерации изображений: DALL-E, Flux, Sora Image и т. д. (кроме gpt-image-1)
- Модели генерации видео: Sora Video, VEO и т. д.
gemini-3-pro-image-preview(псевдонимnano-banana-pro): $0.09/вызовsora_video2: $0.15/вызов (10-секундное видео)flux-1.1-pro: $0.04/вызов
Преимущества оплаты за вызов:
- Прозрачная тарификация, фиксированная стоимость за одну генерацию
- Не нужно рассчитывать расход Tokens
- Подходит для сценариев с фиксированным результатом, например изображений/видео
3. Гибридная тарификация
Определение: Поддерживает как оплату по использованию, так и оплату за вызов; автоматически выбирается в зависимости от модели. Статус: ⚠️ Не применимо4. Приоритет оплаты по использованию (рекомендуется)
Определение: Умный режим тарификации, который в первую очередь использует оплату по использованию, если модель поддерживает оба варианта; автоматически переключается на оплату за вызов, если модель поддерживает только ее. Почему рекомендуется?- ✅ Включает оплату за вызов: можно вызывать модели изображений/видео, тарифицируемые за вызов
- ✅ Включает оплату по использованию: можно вызывать текстовые/мультимодальные модели, тарифицируемые по использованию
- ✅ Автоматическая адаптация: система автоматически выбирает наиболее подходящий способ тарификации
- ✅ Покрывает все сценарии: поддерживаются все 400+ моделей
Причина рекомендации: Использование token «Приоритет оплаты по использованию» позволяет вызывать все модели без создания отдельных token для разных режимов тарификации.
5. Приоритет оплаты за вызов
Определение: В первую очередь использует оплату за вызов, если модель поддерживает оба варианта; автоматически переключается на оплату по использованию, если модель поддерживает только ее. Применимые сценарии:- Сценарии, требующие фиксированных затрат
- В основном при использовании моделей генерации изображений/видео
Рекомендация по использованию: Если нет явного требования к контролю затрат, используйте «Приоритет оплаты по использованию», так как текстовые модели обычно более экономичны при оплате по использованию.
Как выбрать режим тарификации?
Рекомендуемое решение (подходит для 95% пользователей)
Приоритет оплаты по использованию (рекомендуется по умолчанию)
Сценарии применения:
- Одновременное использование text, image и video моделей
- Не нужно создавать разные token для разных моделей
- Нужна максимальная гибкость
- Поддерживает все 400+ моделей
- Система автоматически выбирает оптимальный способ тарификации
- Не требуется дополнительная настройка
Особые сценарии
- Только текстовое приложение
- Только приложение для image/video
- Контроль затрат
Сценарий: Используются только GPT, Claude, Gemini и другие text моделиРекомендуемый режим тарификации: Приоритет оплаты по использованию или Оплата по использованиюПричина: Все text модели используют тарификацию по использованию, оба режима дают одинаковый результат
Вопросы и ответы
Почему для gpt-image-1 требуется токен с оплатой по использованию?
Почему для gpt-image-1 требуется токен с оплатой по использованию?
gpt-image-1 — это официальная модель генерации изображений OpenAI. Хотя она генерирует изображения, метод тарификации у нее похож на текстовые модели, оплата взимается по token.Факторы тарификации:- Разрешение изображения (1024x1024 расходует около ~5000 token, 1792x1024 расходует около ~8500 token)
- Качество изображения (качество HD увеличивает потребление token)
- Используйте token «Приоритет оплаты по использованию» или «Оплата по использованию»
- Использование token «Оплата за вызов» не позволит вызывать
gpt-image-1
Я уже создал token с оплатой за вызов, можно ли изменить его на приоритет оплаты по использованию?
Я уже создал token с оплатой за вызов, можно ли изменить его на приоритет оплаты по использованию?
Да, вы можете изменить его. Шаги:
- Войдите на страницу управления token API.YI
- Найдите соответствующий token и нажмите кнопку «Редактировать» справа
- Выберите «Приоритет оплаты по использованию» в раскрывающемся списке «Режим тарификации»
- Сохраните конфигурацию
В чем разница между приоритетом оплаты по использованию и приоритетом оплаты за вызов?
В чем разница между приоритетом оплаты по использованию и приоритетом оплаты за вызов?
Разные приоритеты:
Рекомендация: в большинстве случаев используйте «Приоритет оплаты по использованию».
Если я выберу неправильный режим тарификации, вызов завершится неудачей?
Если я выберу неправильный режим тарификации, вызов завершится неудачей?
Сразу не завершится неудачей, но вы можете не суметь вызвать некоторые модели.Примеры сценариев:
- Если token имеет режим «Оплата за вызов», вызов
gpt-4oзавершится неудачей (потому что gpt-4o поддерживает только тарификацию по использованию) - Если token имеет режим «Оплата по использованию», вызов
gemini-3-pro-image-previewможет завершиться неудачей (потому что эта модель поддерживает только тарификацию за вызов)
Почему гибридная тарификация не применяется?
Почему гибридная тарификация не применяется?
Гибридная тарификация теоретически поддерживает и оплату по использованию, и оплату за вызов, но на практике может привести к:
- Неясной логике тарификации
- Сложностям с прогнозированием затрат
- Проблемам совместимости системы
Рекомендации по выбору режима тарификации
Лучшая практика: при создании token выбирайте режим тарификации “Приоритетная оплата за использование”, чтобы покрыть все сценарии использования без создания разных token для разных моделей.