Skip to main content
1M のコンテキストを備えた、合計 284B / アクティブ 13B の MoE。高い同時実行数と低レイテンシ向けに設計されており、暗黙的キャッシュは設定不要で、2ターン目からほぼフルのヒットが得られます。

仕様

料金

USD建ての1M tokenあたりの価格($/1M)。
表は定価を示しています。チャージ特典とグループ割引は併用できます。コンソールには実際の課金額がリアルタイムで反映されます。料金チャージ特典 をご覧ください。

エンドポイント

課金グループ

一部のグループには追加割引があり、チャージ特典と併用できます。Tokensとグループをご覧ください。

対応機能

使用例

以下の例では、deepseek-v4-flash を OpenAI Chat Completions(/v1/chat/completions)経由で呼び出します。base_url を https://api.apiyi.com/v1 に指定してください。ほかはすべて公式 API と一致します。
環境変数からキーを読み取り、ハードコードしないでください。本番環境では、用途ごとに個別の token を発行しておくと、個別に失効させたり使用状況を把握したりできます。

関連ドキュメント

リリース発表

DeepSeek V4 Flash の背景、ベンチマーク、移行メモ

概要

パラメータ、使用方法、ベストプラクティス

DeepSeek V4 Pro

同じファミリーのモデルの詳細

モデル料金一覧

296 モデルすべての最新料金、エンドポイント、グループ
このページの仕様は models/data/model-details.json で手動管理されています;料金とエンドポイントはライブ料金 API から取得され、2026-08-17 13:47 (UTC+8) に更新されました。仕様の最終確認日は 2026-08-17 です。