Skip to main content
높은 동시 실행 수와 낮은 지연 시간을 위해 설계된 총 284B / 활성 13B MoE이며, 컨텍스트 윈도우는 1M입니다. 암시적 캐싱은 별도 설정이 필요 없고, 두 번째 턴부터 거의 완전한 캐시 적중을 보입니다.

사양

가격

가격은 1M tokens당 USD입니다($/1M).
이 표는 정가를 보여줍니다. 충전 프로모션과 그룹 할인은 중복 적용되며, 콘솔에는 실제 과금이 실시간으로 반영됩니다. 가격충전 프로모션을 참조하십시오.

엔드포인트

과금 그룹

일부 그룹에는 추가 할인이 적용되며, 충전 보너스와 중복 적용됩니다. Tokens 및 그룹을 참조하십시오.

지원 기능

예제 요청

아래 예제는 OpenAI Chat Completions(/v1/chat/completions)을 통해 deepseek-v4-flash를 호출합니다. base_url을 https://api.apiyi.com/v1로 지정합니다 — 나머지는 모두 공식 API와 같습니다.
환경 변수에서 키를 읽어오며, 절대로 하드코딩하지 않습니다. 프로덕션에서는 사용 사례별로 별도의 token을 발급하여 사용을 개별적으로 폐기하고 추적할 수 있어야 합니다.

관련 문서

출시 공지

DeepSeek V4 Flash의 배경, 벤치마크 및 마이그레이션 노트

개요

매개변수, 사용법 및 모범 사례

DeepSeek V4 Pro

같은 계열 모델에 대한 상세 정보

모델 가격 디렉터리

모든 296개 모델의 실시간 가격, 엔드포인트 및 그룹
이 페이지의 사양은 models/data/model-details.json에서 수동으로 관리되며; 가격과 엔드포인트는 실시간 가격 API에서 가져옵니다. 2026-08-17 13:47 (UTC+8)에 업데이트되었으며, 사양은 2026-08-17에 마지막으로 검증되었습니다.