Skip to main content
1M のコンテキストを備えた、合計 284B / アクティブ 13B の MoE。高い同時実行数と低レイテンシ向けに設計されており、暗黙的キャッシュは設定不要で、2ターン目からほぼフルのヒットが得られます。

仕様

料金

USD建ての1M tokenあたりの価格($/1M)。
表は定価を示しています。チャージ特典とグループ割引は併用できます。コンソールには実際の課金額がリアルタイムで反映されます。料金 と チャージ特典 をご覧ください。

エンドポイント

課金グループ

一部のグループには追加割引があり、チャージ特典と併用できます。Tokensとグループをご覧ください。

対応機能

使用例

以下の例では、deepseek-v4-flash を OpenAI Chat Completions(/v1/chat/completions)経由で呼び出します。base_url を https://api.apiyi.com/v1 に指定してください。ほかはすべて公式 API と一致します。
環境変数からキーを読み取り、ハードコードしないでください。本番環境では、用途ごとに個別の token を発行しておくと、個別に失効させたり使用状況を把握したりできます。

関連ドキュメント

リリース発表

DeepSeek V4 Flash の背景、ベンチマーク、移行に関する注意事項

概要

パラメーター、使用方法、ベストプラクティス

DeepSeek V4 Pro

同じファミリーに属するモデルの詳細

モデル価格一覧

すべてのモデルの最新の価格、エンドポイント、グループ
このページの仕様はmodels/data/model-details.jsonで手動管理されています。価格とエンドポイントは最新の価格 API から取得され、ビルドのたびに更新されます。