Skip to main content
이전 세대의 저비용 멀티모달 추론 모델입니다. 1M 컨텍스트, 최대 65K 출력 및 256K 추론 예산을 제공하며, 멀티모달 에이전트와 시각적 코딩을 대상으로 합니다.

사양

가격

1M token당 USD 가격($/1M)입니다.
표에는 정가가 표시됩니다. 충전 프로모션과 그룹 할인이 중복 적용되며, 콘솔에는 실제 과금액이 실시간으로 반영됩니다. 가격충전 프로모션을 참조하십시오.

엔드포인트

과금 그룹

일부 그룹에는 추가 할인이 적용되며, 충전 보너스와 중복 적용할 수 있습니다. 토큰 및 그룹을 참조하십시오.

지원 기능

예시 요청

아래 예시에서는 OpenAI 채팅 완성(/v1/chat/completions)을 통해 qwen3.7-flash을 호출합니다. base_url을 https://api.apiyi.com/v1로 지정하면 됩니다. 그 외의 모든 사항은 공식 API와 동일합니다.
키는 환경 변수에서 읽고, 하드코딩하지 마십시오. 프로덕션에서는 사용 사례별로 별도의 token을 발급하여 개별적으로 철회하고 사용량을 귀속할 수 있도록 하십시오.

관련 문서

Qwen3.8-Flash

동일한 제품군에 속한 모델의 세부 정보

모델 과금 디렉터리

289개 모델 전체의 실시간 과금, 엔드포인트 및 그룹
이 페이지의 사양은 models/data/model-details.json에서 수동으로 관리되며, 과금 및 엔드포인트는 실시간 과금 API에서 가져옵니다. 2026-09-03 01:13 (UTC+8)에 업데이트되었으며, 사양은 2026-09-03에 마지막으로 확인되었습니다.