Skip to main content
POST
Chat completion: Gemini 3.5 Flash-Lite (OpenAI-compatible)
Используйте песочницу справа: поместите Bearer sk-your-api-key в Authorization и нажмите «Отправить» — по умолчанию без рассуждения, поэтому ответы быстрые.
Для глубокого рассуждения передайте reasoning_effort: "high" (примечание: этот endpoint не сообщает reasoning_tokens для этой модели — используйте Нативную песочницу для точного наблюдения за рассуждением). Привязка к поиску, выполнение кода и другие нативные инструменты недоступны на этом endpoint. Обзор и измеренные данные: Обзор Gemini 3.5 Flash-Lite.

Краткая справка по параметрам

Примечания к ответу

  • usage.completion_tokens_details.reasoning_tokens не сообщается для этой модели (3.6 Flash сообщает его) — расход на рассуждение включен в completion_tokens
  • Текст рассуждения (reasoning_content) не возвращается в этом эндпоинте
  • Еще раз проверьте имя модели gemini-3.5-flash-lite (три сегмента в нижнем регистре, через дефис)

Авторизации

Authorization
string
header
обязательно

Add Authorization: Bearer YOUR_API_KEY header

Тело

application/json
model
string
обязательно

Fixed: gemini-3.5-flash-lite

messages
object[]
обязательно

Standard OpenAI messages array

max_tokens
integer

Output quota; 2000+ recommended with thinking on (thinking bills as output)

temperature
number
stream
boolean

SSE streaming

reasoning_effort
enum<string>

Thinking tier

Доступные опции:
low,
medium,
high
response_format
object

Structured output, json_schema supported

tools
object[]

Function-calling tool list

Ответ

Success

id
string
model
string
choices
object[]
usage
object

Usage stats