Skip to main content
Легковесный тарифный уровень с высокой пропускной способностью: по умолчанию без рассуждения и с ответами примерно за две секунды, создан для параллельных запросов и пакетных задач.

Технические характеристики

Цены

Цены в USD за 1M token ($/1M).
В таблице показаны базовые цены. Акции пополнения и скидки группы суммируются; консоль в реальном времени отображает фактическую сумму списания. См. Цены и Акции пополнения.

Эндпоинты

Группы тарификации

Для некоторых групп действуют дополнительные скидки, которые суммируются с бонусами за пополнение. См. Tokens и группы.

Поддерживаемые возможности

Пример запроса

Пример ниже вызывает gemini-3.5-flash-lite через OpenAI Chat Completions (/v1/chat/completions). Укажите base_url на https://api.apiyi.com/v1 — все остальное соответствует официальному API.
Считывайте ключ из переменной окружения, никогда не жестко заданным в коде. В продакшене выдавайте отдельные tokens для каждого сценария использования, чтобы вы могли отзывать их и отдельно учитывать использование.

Связанные документы

Объявление о запуске

Предыстория, результаты тестов и примечания по миграции для Gemini 3.5 Flash-Lite

Обзор

Параметры, использование и рекомендации

Нативные вызовы

Параметры, использование и рекомендации

Gemini 3.6 Flash

Сведения о модели из того же семейства

Gemini 3.5 Flash

Сведения о модели из того же семейства

Каталог тарифов моделей

Актуальные тарифы, эндпоинты и группы для всех моделей
Спецификации на этой странице поддерживаются вручную в models/data/model-details.json; тарифы и эндпоинты поступают из API актуальных тарифов и обновляются при каждой пересборке.