Skip to main content
POST
Chat completion: Gemini 3.6 Flash (OpenAI-compatible)
오른쪽 플레이그라운드를 사용하십시오: Bearer sk-your-api-keyAuthorization에 넣으십시오. 기본 예제는 reasoning_effort: "low"를 사용합니다. 전송하여 응답을 확인하십시오.
Thinking은 기본적으로 ON입니다(출력으로 과금됩니다). 디버깅할 때는 low로 유지하십시오. 복잡한 작업에는 max_tokens가 4000+일 때 high로 전환하십시오. 검색 grounding, code execution 및 기타 네이티브 tools는 이 엔드포인트에서 사용할 수 없습니다 — 대신 Native Playground을 사용하십시오. 개요 및 측정 데이터: Gemini 3.6 Flash Overview.

매개변수 빠른 참조

응답 참고사항

  • 추론 사용량은 usage.completion_tokens_details.reasoning_tokens입니다(이 모델에 대해 보고됩니다)
  • 이 엔드포인트에서는 Thinking text(reasoning_content)가 다시 출력되지 않습니다 - 네이티브 엔드포인트의 includeThoughts를 사용하여 생각을 확인하십시오
  • 모델 이름 gemini-3.6-flash를 다시 확인하십시오 - 오타가 있으면 조용한 대체 동작 대신 오류가 반환됩니다

인증

Authorization
string
header
필수

Add Authorization: Bearer YOUR_API_KEY header

본문

application/json
model
string
필수

Fixed: gemini-3.6-flash

messages
object[]
필수

Standard OpenAI messages array

max_tokens
integer

Output quota; 2000+ recommended with thinking on (thinking bills as output)

temperature
number
stream
boolean

SSE streaming

reasoning_effort
enum<string>

Thinking tier

사용 가능한 옵션:
low,
medium,
high
response_format
object

Structured output, json_schema supported

tools
object[]

Function-calling tool list

응답

Success

id
string
model
string
choices
object[]
usage
object

Usage stats