Skip to main content
Низкозатратный уровень с высокой пропускной способностью и настраиваемыми уровнями рассуждения, подходит для параллельных запросов и пакетной обработки.

Спецификации

Цены

Цены в USD за 1M tokens ($/1M).
В таблице указаны базовые цены. Промо-акции на пополнение и скидки группы складываются; консоль отображает фактическую тарификацию в реальном времени. См. Цены и Промо-акции на пополнение.

Эндпоинты

Группы тарификации

Для некоторых групп действуют дополнительные скидки, суммируемые с бонусами за пополнение. См. tokens и группы.

Поддерживаемые функции

Варианты

Пример запроса

Пример ниже вызывает gemini-3.1-flash-lite через OpenAI Chat Completions (/v1/chat/completions). Укажите base_url на https://api.apiyi.com/v1 — все остальное совпадает с официальным API.
Получайте ключ из переменной окружения, никогда не встраивайте его жестко. В production выпускайте отдельные token для каждого сценария использования, чтобы вы могли отзывать их и учитывать использование по отдельности.

Связанные документы

Объявление о запуске

Сведения о предыстории, результатах тестирования и заметки по миграции для Gemini 3.1 Flash-Lite

Нативные вызовы

Параметры, использование и рекомендации

Gemini 3.5 Flash-Lite

Подробные сведения о модели из того же семейства

Каталог тарифов моделей

Актуальные тарифы, эндпоинты и группы для всех моделей
Спецификации на этой странице поддерживаются вручную в models/data/model-details.json; тарифы и эндпоинты поступают из актуального API тарификации и обновляются при каждой пересборке.