Skip to main content
前世代の低コストなマルチモーダル推論モデルです。1M のコンテキストウィンドウ、65K の最大出力、256K の thinking budget を備え、マルチモーダルエージェントとビジュアルコーディングを対象としています。

仕様

料金

1M token あたりの米ドル価格($/1M)です。
この表は定価を示しています。チャージキャンペーンとグループ割引は併用され、コンソールには実際の課金額がリアルタイムで反映されます。料金チャージキャンペーンをご覧ください。

エンドポイント

課金グループ

一部のグループには追加割引が適用され、チャージボーナスと併用できます。トークンとグループをご覧ください。

対応機能

リクエスト例

以下の例では、qwen3.7-flashをOpenAI Chat Completions(/v1/chat/completions)経由で呼び出します。base_urlにはhttps://api.apiyi.com/v1を指定します。それ以外はすべて公式APIと同じです。
キーは環境変数から読み込み、ハードコードしないでください。本番環境では、用途ごとに個別のtokenを発行して、必要に応じて個別に失効させ、使用状況を個別に追跡できるようにしてください。

関連ドキュメント

Qwen3.8-Flash

同じファミリーに属するモデルの詳細

モデル料金ディレクトリ

全289モデルの最新の料金、エンドポイント、グループ
このページの仕様はmodels/data/model-details.jsonで手動管理されています。料金とエンドポイントはライブ料金 APIから取得され、2026-09-03 01:13 (UTC+8) に更新されています。仕様の最終確認日は2026-09-03です。