Skip to main content

Краткий ответ

Рекомендуемая настройка: При создании token выберите режим тарификации “Pay-per-Use Priority”, который подходит для большинства сценариев.
Хотя система предоставляет 5 типов тарификации, использование “Pay-per-Use Priority” по умолчанию покрывает все сценарии вызова моделей. Выбор режима тарификации для token

5 Объяснение режимов тарификации

1. Оплата по использованию (на основе Tokens)

Определение: Тарификация на основе количества Tokens для входных и выходных данных; вы платите только за то, что используете. Применимые модели:
  • Модели генерации текста: GPT-4, Claude, Gemini, DeepSeek и т. д.
  • Модели мультимодального понимания: модели, поддерживающие ввод изображений/аудио
  • Специальные модели изображений: gpt-image-1 (тарифицируются по Tokens)
Формула тарификации:
Примеры:
  • gpt-4o: Вход $5/миллион tokens, Выход $15/миллион tokens
  • claude-3-5-sonnet-20241022: Вход $3/миллион tokens, Выход $15/миллион tokens
Особое примечание по gpt-image-1: Хотя это модель генерации изображений, она тарифицируется по Tokens. На Tokens влияют следующие факторы:
  • Разрешение изображения (1024x1024, 1792x1024 и т. д.)
  • Качество изображения (standard, hd)
OpenAI предоставляет подробную таблицу тарификации с различным расходом Tokens для разных разрешений и качеств.

2. Оплата за вызов

Определение: Фиксированная плата за каждый вызов, не зависящая от входных и выходных Tokens. Применимые модели:
  • Модели генерации изображений: DALL-E, Flux, Sora Image и т. д. (кроме gpt-image-1)
  • Модели генерации видео: Sora Video, VEO и т. д.
Формула тарификации:
Примеры:
  • gemini-3-pro-image-preview (псевдоним nano-banana-pro): $0.09/вызов
  • sora_video2: $0.15/вызов (10-секундное видео)
  • flux-1.1-pro: $0.04/вызов
Преимущества оплаты за вызов:
  • Прозрачная тарификация, фиксированная стоимость за одну генерацию
  • Не нужно рассчитывать расход Tokens
  • Подходит для сценариев с фиксированным результатом, например изображений/видео

3. Гибридная тарификация

Определение: Поддерживает как оплату по использованию, так и оплату за вызов; автоматически выбирается в зависимости от модели. Статус: ⚠️ Не применимо
В настоящее время платформа API.YI не рекомендует использовать режим «Гибридная тарификация», поскольку это может вызвать путаницу в тарификации. Вместо этого используйте «Приоритет оплаты по использованию».

4. Приоритет оплаты по использованию (рекомендуется)

Определение: Умный режим тарификации, который в первую очередь использует оплату по использованию, если модель поддерживает оба варианта; автоматически переключается на оплату за вызов, если модель поддерживает только ее. Почему рекомендуется?
  • Включает оплату за вызов: можно вызывать модели изображений/видео, тарифицируемые за вызов
  • Включает оплату по использованию: можно вызывать текстовые/мультимодальные модели, тарифицируемые по использованию
  • Автоматическая адаптация: система автоматически выбирает наиболее подходящий способ тарификации
  • Покрывает все сценарии: поддерживаются все 400+ моделей
Логика тарификации:
Примеры сценариев:
Причина рекомендации: Использование token «Приоритет оплаты по использованию» позволяет вызывать все модели без создания отдельных token для разных режимов тарификации.

5. Приоритет оплаты за вызов

Определение: В первую очередь использует оплату за вызов, если модель поддерживает оба варианта; автоматически переключается на оплату по использованию, если модель поддерживает только ее. Применимые сценарии:
  • Сценарии, требующие фиксированных затрат
  • В основном при использовании моделей генерации изображений/видео
Логика тарификации:
Рекомендация по использованию: Если нет явного требования к контролю затрат, используйте «Приоритет оплаты по использованию», так как текстовые модели обычно более экономичны при оплате по использованию.

Как выбрать режим тарификации?

Рекомендуемое решение (подходит для 95% пользователей)

Приоритет оплаты по использованию (рекомендуется по умолчанию)

Сценарии применения:
  • Одновременное использование text, image и video моделей
  • Не нужно создавать разные token для разных моделей
  • Нужна максимальная гибкость
Преимущества:
  • Поддерживает все 400+ моделей
  • Система автоматически выбирает оптимальный способ тарификации
  • Не требуется дополнительная настройка

Особые сценарии

Сценарий: Используются только GPT, Claude, Gemini и другие text моделиРекомендуемый режим тарификации: Приоритет оплаты по использованию или Оплата по использованиюПричина: Все text модели используют тарификацию по использованию, оба режима дают одинаковый результат

Вопросы и ответы

gpt-image-1 — это официальная модель генерации изображений OpenAI. Хотя она генерирует изображения, метод тарификации у нее похож на текстовые модели, оплата взимается по token.Факторы тарификации:
  • Разрешение изображения (1024x1024 расходует около ~5000 token, 1792x1024 расходует около ~8500 token)
  • Качество изображения (качество HD увеличивает потребление token)
Решение:
  • Используйте token «Приоритет оплаты по использованию» или «Оплата по использованию»
  • Использование token «Оплата за вызов» не позволит вызывать gpt-image-1
Да, вы можете изменить его. Шаги:
  1. Войдите на страницу управления token API.YI
  2. Найдите соответствующий token и нажмите кнопку «Редактировать» справа
  3. Выберите «Приоритет оплаты по использованию» в раскрывающемся списке «Режим тарификации»
  4. Сохраните конфигурацию
Примечание: изменения вступают в силу немедленно и не влияют на существующий баланс.
Разные приоритеты:Рекомендация: в большинстве случаев используйте «Приоритет оплаты по использованию».
Сразу не завершится неудачей, но вы можете не суметь вызвать некоторые модели.Примеры сценариев:
  • Если token имеет режим «Оплата за вызов», вызов gpt-4o завершится неудачей (потому что gpt-4o поддерживает только тарификацию по использованию)
  • Если token имеет режим «Оплата по использованию», вызов gemini-3-pro-image-preview может завершиться неудачей (потому что эта модель поддерживает только тарификацию за вызов)
Решение: используйте «Приоритет оплаты по использованию», чтобы избежать этой проблемы.
Гибридная тарификация теоретически поддерживает и оплату по использованию, и оплату за вызов, но на практике может привести к:
  • Неясной логике тарификации
  • Сложностям с прогнозированием затрат
  • Проблемам совместимости системы
Альтернатива: используйте «Приоритет оплаты по использованию», чтобы добиться того же эффекта с большей стабильностью и надежностью.

Рекомендации по выбору режима тарификации

Лучшая практика: при создании token выбирайте режим тарификации “Приоритетная оплата за использование”, чтобы покрыть все сценарии использования без создания разных token для разных моделей.

Связанная документация