Skip to main content
POST
Chat completion: Gemini 3.5 Flash-Lite (OpenAI-compatible)
오른쪽의 플레이그라운드를 사용하십시오: Bearer sk-your-api-keyAuthorization에 넣고 전송을 누르십시오 — 기본적으로 추론을 하지 않으므로 응답이 빠릅니다.
심층 추론을 위해 reasoning_effort: "high"를 전달하십시오(참고: 이 엔드포인트는 이 모델에 대해 reasoning_tokens를 보고하지 않습니다 — 정확한 추론 관찰을 위해 네이티브 플레이그라운드를 사용하십시오). 검색 그라운딩, 코드 실행 및 기타 네이티브 도구는 이 엔드포인트에서 사용할 수 없습니다. 개요 및 측정 데이터: Gemini 3.5 Flash-Lite 개요.

매개변수 빠른 참고

응답 참고사항

  • usage.completion_tokens_details.reasoning_tokens는 이 모델에서는 보고되지 않습니다(3.6 Flash는 보고합니다) — thinking 사용량은 completion_tokens에 포함됩니다
  • Thinking text(reasoning_content)는 이 엔드포인트에서 그대로 표시되지 않습니다
  • 모델 이름 gemini-3.5-flash-lite(세 개의 소문자 세그먼트로 이루어진 하이픈 연결 형식)을 다시 확인하십시오

인증

Authorization
string
header
필수

Add Authorization: Bearer YOUR_API_KEY header

본문

application/json
model
string
필수

Fixed: gemini-3.5-flash-lite

messages
object[]
필수

Standard OpenAI messages array

max_tokens
integer

Output quota; 2000+ recommended with thinking on (thinking bills as output)

temperature
number
stream
boolean

SSE streaming

reasoning_effort
enum<string>

Thinking tier

사용 가능한 옵션:
low,
medium,
high
response_format
object

Structured output, json_schema supported

tools
object[]

Function-calling tool list

응답

Success

id
string
model
string
choices
object[]
usage
object

Usage stats