Skip to main content
POST
Chat completion: Gemini 3.6 Flash (OpenAI-compatible)
Используйте playground справа: поместите Bearer sk-your-api-key в Authorization. В примере по умолчанию используется reasoning_effort: "low"; нажмите отправку, чтобы увидеть ответ.
Рассуждение включено по умолчанию (тарифицируется как output). Оставляйте его на low для отладки; переключайтесь на high с max_tokens на 4000+ для сложных задач. Search grounding, code execution и другие встроенные инструменты недоступны в этом эндпоинте — вместо этого используйте Native Playground. Обзор и измеренные данные: Обзор Gemini 3.6 Flash.

Краткая справка по параметрам

Примечания к ответу

  • Расход на рассуждение составляет usage.completion_tokens_details.reasoning_tokens (указано для этой модели)
  • Текст рассуждений (reasoning_content) не выводится на этом эндпоинте — используйте includeThoughts нативного эндпоинта, чтобы просмотреть мысли
  • Перепроверьте название модели gemini-3.6-flash — опечатки возвращают ошибку, а не выполняют незаметный fallback

Авторизации

Authorization
string
header
обязательно

Add Authorization: Bearer YOUR_API_KEY header

Тело

application/json
model
string
обязательно

Fixed: gemini-3.6-flash

messages
object[]
обязательно

Standard OpenAI messages array

max_tokens
integer

Output quota; 2000+ recommended with thinking on (thinking bills as output)

temperature
number
stream
boolean

SSE streaming

reasoning_effort
enum<string>

Thinking tier

Доступные опции:
low,
medium,
high
response_format
object

Structured output, json_schema supported

tools
object[]

Function-calling tool list

Ответ

Success

id
string
model
string
choices
object[]
usage
object

Usage stats