Skip to main content
고처리량 경량 티어: 기본적으로 추론 없이 동작하며 대략 2초 응답을 제공하고, 동시 실행 수와 배치 작업에 맞게 설계되었습니다.

사양

가격

1M tokens당 USD 가격($/1M).
표는 정가를 보여줍니다. 충전 프로모션과 그룹 할인은 중복 적용됩니다; 콘솔에는 실제 과금이 실시간으로 반영됩니다. 가격충전 프로모션을 참조하십시오.

엔드포인트

과금 그룹

일부 그룹에는 추가 할인 혜택이 적용되며, 충전 보너스와 중복 적용됩니다. Tokens와 그룹을 참조하십시오.

지원 기능

예제 요청

아래 예제는 OpenAI Chat Completions(/v1/chat/completions)을 통해 gemini-3.5-flash-lite를 호출합니다. base_url을 https://api.apiyi.com/v1로 지정합니다 — 나머지는 모두 공식 API와 일치합니다.
환경 변수에서 키를 읽어오며, 절대로 하드코딩하지 마십시오. 운영 환경에서는 사용 사례별로 별도의 token을 발급하여, 사용을 개별적으로 취소하고 추적할 수 있어야 합니다.

관련 문서

출시 공지

Gemini 3.5 Flash-Lite의 배경, 벤치마크 및 마이그레이션 참고 사항

개요

파라미터, 사용법 및 모범 사례

네이티브 호출

파라미터, 사용법 및 모범 사례

Gemini 3.6 Flash

같은 계열의 모델에 대한 자세한 정보

Gemini 3.5 Flash

같은 계열의 모델에 대한 자세한 정보

모델 가격 디렉터리

모든 296개 모델의 실시간 가격, 엔드포인트 및 그룹
이 페이지의 사양은 models/data/model-details.json에서 수동으로 관리되며, 가격과 엔드포인트는 실시간 가격 API에서 가져옵니다. 2026-08-17 13:47 (UTC+8)에 업데이트되었으며, 사양은 2026-07-31에 마지막으로 검증되었습니다.