概要
doubao-seedance-2-5-260628(2.5)、doubao-seedance-2-0-260128(標準)、doubao-seedance-2-0-fast-260128(高速)、および doubao-seedance-2-0-mini-260615(ミニ/Lite)は、ByteDance の最新動画生成モデルファミリーです。4つのモデルが並行して稼働し、上流のコンテンツ安全対策を組み込んだ Volcengine 中国本土の公式リソース(BytePlus 国際版ではありません)を通じて APIYI から提供されます。テキストから動画、最初+最後/最初のフレーム画像から動画、マルチモーダル参照から動画をサポートし、映像と同期した音声、効果音、BGMを生成できます。 2.5 は最も高性能なティアです。最長時間は15秒から 30秒 に、参照画像は9枚から 30枚 に拡張され、音声単体を参照として使用できるほか、明示的な動画編集/延長タスクタイプと mov 出力が追加されています。コストも高くなります。720p/5秒の場合、2.0標準モデルの約1.5倍(約 $0.91 に対して約 $1.35)であり、Volcengine 自身の定価における2世代間の価格差と一致します。2.0ファミリーは引き続き利用可能で、廃止されません。15秒未満の通常クリップでは標準モデルの方が低価格で、1080p もサポートしています。ミニは大量制作向けの選択肢です(標準モデルの単価の約半額で、生成も高速、720pまで)。高速モデルはその中間に位置します。 2.5 は2.0ファミリーと同じSeeDance2 グループ(0.18x)で稼働します。1つの token ですべての4モデルにアクセスできます。以下の「グループ設定」を参照してください。
-1 を受け付けます)。3つの解像度ティア(480p/720p/1080p、1080p は2.5および2.0標準のみ対応)、6つのアスペクト比とアダプティブ、同期オーディオはデフォルトで有効、多言語 prompt に対応しています。大規模な ショート動画制作、ECアセット、モーションデザイン、バーチャルヒューマンコンテンツ 向けに構築されています。SD2Mini(0.10x)および SD2Fast(0.15x)により、mini は44.4%、fast は16.7% レートが下がります。新しい Token に切り替えるだけで利用でき、コード変更は不要です。以下の「期間限定割引グループ」と「グループ設定」を参照してください。動画生成 API リファレンス
POST /seedance/api/v3/contents/generations/tasks — インタラクティブな Playground と完全なポーリング/ダウンロードコードを備えた非同期タスクエンドポイントです。API マニュアル
ビジュアル API テスト
非同期タスクの検索/ダウンロード
AI エージェントに統合を任せる
.md を追加)、その後、プロジェクト独自のスタックでコードを作成します。非同期ポーリング、即時コピーを必須にする24時間のリンク有効期限、gzip ヘッダーの落とし穴、パラメーターの禁止事項は、すでに要件に組み込まれています。このプロジェクトに Seedance 2.5 / 2.0 の動画生成を統合またはトラブルシューティングさせます。Codex、Claude Code、Cursor などのツールにコピー&ペーストしてください。
この prompt が防いでくれること
この prompt が防いでくれること
APIYI の Seedance を選ぶ理由
まず位置づけについて補足します。このモデルには公式割引はなく、APIYI も利益目的で価格設定していません。供給を確保し、お客様に提供するために提供しています。APIYI を利用する真の価値は「より安い」ことではなく、アクセス性と体験にあります。公式リソース・中国本土版
バーチャル顔ホワイトリストへのアクセス
アセットライブラリを無料で提供
供給優先の価格設定・公式と同水準
同時実行数無制限・待機なし
running に入りました(2026-06-06 (UTC+8) に計測)。大規模なバッチ生成に対応できます。手間のないアクセス・本人確認不要
api.apiyi.com に直接アクセスできます。プロフェッショナルサポート
主な機能
3つの画質 · 各画質で同一価格
音声はデフォルトで同期
generate_audioはデフォルトでtrueです。音声、効果音、BGMは映像に合わせて生成されます。ボイスオーバーの品質を高めるには、発話内容を二重引用符で囲んでください。最大30秒の長さを制御可能
-1ではモデルが長さを選択します(実際の出力長に基づいて課金されます)。2.5ではdurationのデフォルト値は-1です。省略すると、モデルが自動的に選択します。フレームレートは24 fps固定です。多言語プロンプト
最初+最後 / 最初のフレーム
return_last_frameと組み合わせることで、クリップを連結してより長く連続した動画を作成できます。マルチモーダルな参照画像からの動画生成
非同期タスクフロー
task_idを取得し、ステータスをポーリングした後、content.video_urlからmp4をダウンロードします(リンクの有効期間は24時間です)。再現可能なシード
seedを固定すると、実行ごとに類似した結果を得られます。watermarkはデフォルトでfalseです。出力にウォーターマークは入りません。料金
tokens ≈ (input video duration + output duration)(s) × output width × output height × 24 / 1024(テキスト/画像から動画への変換では、入力動画の長さは0です。当社のテストでは誤差0.1%以内で検証済みです)。各ティア内のすべての比率でピクセル面積が同じであるため、料金は解像度ティア、出力時間、入力に動画が含まれるかどうかだけで決まります。
公式価格の基準値(16:9 / 5秒出力、動画あたりのCNY)
① 入力動画なし(テキストから動画 / 画像から動画 / 参照画像):video_urlを含むマルチモーダル参照;入力動画は2~15秒、下限は約2~4秒の入力、高限は約15秒の入力):
usage.completion_tokensです。usage.completion_tokensです。
Seedance 2.5 の料金(SeeDance2 グループ、0.18倍)
2.5と2.0ファミリーは、同じSeeDance2グループと同じ0.18倍のレートを共有しています。世代間の差は、モデル自身の単価によるものだけです。720p/5秒の場合、2.5では$1.3721、2.0の標準モデルでは$0.9074で、およそ1.5倍です。この差はVolcengine自身の公式リスト価格を反映しています(2.5のtokenレートは2.0より約52%高い)。APIYIによる上乗せではありません。アップグレードに価値があるかどうかは、30秒のクリップ、30枚の参照画像、mov出力、または動画編集・延長が本当に必要かどうかで決まります。必要ない場合は、2.0の標準モデルのほうが安く、1080pにも対応しています。
① 入力に動画がない場合(text-to-video、image-to-video、参照画像):
video_urlを含むマルチモーダル参照、動画編集、動画延長):別の低いtokenレートで課金されます。
SeeDance2グループに基づいているため、直接比較できます。fastとminiには、より低い料金の期間限定割引グループもあります。次のセクションを参照してください。
- 最終的な料金は、コンソールのモデル料金と呼び出しログに従います
- タスクは送信時に前払い請求され、完了時に精算されます。残高は一時的に変動します。呼び出しログと照合してください。1本の動画では2件の課金エントリが生成されます(下記の「ログで課金を確認する」を参照)
- 仮押さえ額は解像度に関係なく、長さだけに基づきます:2.0ファミリーは1秒あたり$0.09、2.5は1秒あたり$0.135です。そのため、1080pでは通常、最終精算時に追加課金が発生し、480pでは通常、一部返金が発生します。いずれも正常な動作です
- 拒否されたリクエスト(HTTP 400のパラメータエラーなど)は課金されません(検証済み)
- 料金は長さに比例します。15秒の動画は、5秒の動画の約3倍の料金です
期間限定割引グループ(mini / fast のみ、10/7まで)
SD2Mini(0.10x レート)および SD2Fast(0.15x レート)です。通常の SeeDance2 グループの0.18xと比較して、mini は44.4%割引、fast は16.7%割引です。モデル機能、パラメータ、エンドポイント、呼び出し構文に変更はありません。Tokenを1つ差し替えるだけで、コードはそのままです。キャンペーンは 2026-10-07 23:59 (UTC+8) まで実施します(Volcengineの公式プロモーションに合わせて2026-09-05に延長。元の終了日は9月7日でした)。ログで課金を確認する(事前課金 + 精算)
api.apiyi.com/log でコンソールのログページを開き、モデル名 doubao-seedance-2-0 を検索すると、すべての課金を確認できます。1本の動画では2つの課金エントリが生成されます:
- 事前課金:タスク送信時に差し引かれる見積額(「非ストリーミング」と表示され、tokenとグループが表示されるログエントリ)— 下のスクリーンショットでは $0.449998
- 精算(追加課金または返金):タスク完了後、実際に生成されたtokensに基づいて差額が精算されます(「ストリーミング」と表示され、完了token数を含むログエントリ)— 下では $5.611858。1080pでは通常、追加課金が発生します

Two charge entries for one 15 s 1080p video: pre-charge + settlement
- 最初のエントリ(事前課金)のタイムスタンプは動画の送信時刻です。「ファーストバイト」の値は、送信からタスクIDが返されるまでの時間を示します(例:
首字节:3秒/ ファーストバイト:3秒)— 生成時間ではありません - 精算エントリには
流式(ストリーミング)および首字节:<1秒(1秒未満のファーストバイト)が表示されます。これらは精算レコード上の内部マーカーにすぎず、問題があることを示すものではありません - 動画の実際の生成時間は、上部ナビゲーションの「非同期タスク」ページ(
api.apiyi.com/task)にある「所要時間」列で確認できます

The first log entry's timestamp = submission time, and its first-byte value (3 s) is the submission latency; this fast example settled as a refund (negative amount), total cost 0.360000 − 0.022750 = 0.337250 USD

The elapsed column on the Async tasks page is the actual video generation time, e.g. 158 s, 303 s
api.apiyi.com/task の上部にある「非同期タスク」で確認でき、課金額と完全に一致します:
グループ設定
Seedance 2.5 と 2.0 ファミリーは専用グループで稼働し、2 つの必須要件があります。① Token の課金モデルが Pay-as-you-go Priority(または Pay-as-you-go)であること。リクエスト単位課金の Token はルーティングできません。② Token で対応するグループが有効になっていることです。Default グループまたは他の動画グループの Token では、「このモデルで利用可能なチャネルがありません」というエラーになります。 現在、グループは 3 つあります。2.5 と 2.0 ファミリーはSeeDance2 を共有し、さらに各 1 モデルのみを提供する期間限定割引グループが 2 つあります。
SeeDance2 Token ですべての 4 モデルにアクセスできます:2.5 と 2.0 ファミリーの 3 モデルはすべてこのグループにあるため、コードでは model フィールドを変更するだけです。2 つの割引グループは単一モデルのチャネルです:SD2Mini は mini のみ、SD2Fast は fast のみを提供するため、これらを通じて他のモデルを呼び出すと同じエラーが返されます。キャンペーン終了時の停止はありません:2026-10-07 23:59 (UTC+8) 以降も、両方の割引グループはレートが 0.18x に戻ってオンラインのままです。Token やコードを変更する必要はありません。Token の設定方法
割引を狙わない場合:SeeDance2 グループを有効にした Token を 1 つ作成してください。全 4 モデルにアクセスでき、以下の表は不要です。
期間限定割引を利用する場合:mini と fast にはそれぞれ専用の単一モデルグループがあるため、以下のように Token を分けてください。
doubao-seedance-2-5-260628 で、2.0 ファミリーと同じ**SeeDance2 グループ**(0.18x)にあります。エンドポイント、認証、リクエスト形式は 2.0 と同一です。model フィールドを差し替えるだけで、コードはそのまま動作します。2.0 ファミリーと比較すると、最大時間は 15 秒 → 30 秒、参照画像は 9 → 30、参照動画/音声は 3 → 10、音声単独での使用、さらに mov 出力と omni_reference_task_type タスクセレクターに対応しています。実行速度は 2.0 standard モデルのおよそ 1.5 倍です。完全な差分については、以下の「技術仕様」を参照してください。技術仕様
API エンドポイント
解像度とアスペクト比の詳細
解像度ティアは短辺ではなく、ピクセル面積を定義します。比率ごとの実際の出力寸法(公式値、テストで検証済み)は次のとおりです。4kをサポートしていません。"resolution": "4k"を送信すると同期400が返されます(課金対象外)。アダプティブ動作の仕組み
- テキストから動画:モデルがpromptから最適な比率を推測します
- 最初+最後 / 最初のフレーム:最初のフレーム画像の比率に合わせます(比率が一致しない画像は中央でクロップされます)
- マルチモーダル参照から動画:promptの意図に従い、それ以外の場合は最初のメディア項目に従います(画像より動画が優先されます)
- 動画編集 / 拡張(2.5):出力比率は、編集または拡張する入力動画に従います
- 実際に使用された比率は、タスクレスポンスの
ratioフィールドで返されます
ベストプラクティス
出力要件に応じてモデルを選択する
doubao-seedance-2-5-260628を選択します(標準モデルの約1.5倍の価格で、2.0ファミリーと同じグループです)。必要ない場合は、2.0ファミリーを使用します:バッチ生成やコスト重視のワークロードにはLiteモデルを使用します doubao-seedance-2-0-mini-260615(標準モデルの約半額で、生成速度が最も速く、720pまでに制限されます)。1080pまたは最高品質が必要な場合は標準モデルを使用します。fastはその中間的な選択肢です。画像と動画はまずアセット IDに取り込む
asset://アセット IDを取得して、それを参照してください。これにより、リクエストボディは数十バイトに縮小され、タスク IDがすぐに返され、コンテンツチェックも取り込み時に実行されます。アセット優先ワークフローを参照してください。クロッピングを避けるにはadaptiveを使用する
adaptiveを使用してください。9:16(縦向き)または16:9(横向き)に固定するのは、対象プラットフォームでその指定が必要な場合だけにしてください。長さでコストを調整する
durationを明示的に指定してください。デフォルトは-1なので、省略するとモデルが選択します。テストでは10秒が選択され、コストが2倍になりました。不要な場合は音声をオフにする
generate_audioのデフォルト値はtrueです。自分で音楽を付ける予定の無音映像には、falseを指定してください。より自然なボイスオーバーのためにセリフを引用符で囲む
HTTPクライアントにAccept-Encoding: identityを追加する
content-encoding: gzipというラベルを付けますが、ボディは圧縮されていません。Python requestsなどの自動展開クライアントではContentDecodingErrorが発生します。Accept-Encoding: identityヘッダーを追加するとこれを回避できます(curlには影響ありません)。15~30秒ごとにポーリングし、すぐにダウンロードする
content.video_urlは24時間有効な署名付きリンクです。タスクが成功したら、できるだけ早くファイルを自分のストレージにコピーしてください。return_last_frameでクリップを連結する
return_last_frame: trueを設定すると、ウォーターマークのない最後のフレームのpngを取得できます。それを次のタスクの最初のフレームとして使用し、複数のクリップから連続した動画を作成します。エラーコードとリトライ
- 作成/ポーリング呼び出しでは、リクエストタイムアウトは 30~60 秒で十分です(待機はタスク側で発生します)
- 全体の時間枠を 15 分以上として、15~30 秒ごとにポーリングしてください(1080p/15 秒タスクではさらに長くしてください)
- 5xx およびタイムアウト時には 指数バックオフを適用してください(2 回リトライ)
- トラブルシューティングのため、タスク
idとx-request-idレスポンスヘッダーをログに記録してください
FAQ
画像または動画を含むリクエストで、タスク ID の返却に時間がかかったり、タイムアウトしたりするのはなぜですか?
画像または動画を含むリクエストで、タスク ID の返却に時間がかかったり、タイムアウトしたりするのはなぜですか?
asset:// アセット ID として参照することです。これにより、リクエスト本文を数メガバイトから数十バイトに削減できます。レイテンシの内訳、移行手順、タイムアウト後にタスクが作成されたかどうかの確認方法については、アセット優先ワークフローを参照してください。Seedance 2.5 と 2.0 のどちらを使うべきですか?
Seedance 2.5 と 2.0 のどちらを使うべきですか?
omni_reference_task_type)。2.5 では音声のみを参照素材にすることも可能ですが、2.0 では音声とともに画像または動画も必要です。クリップが 15 秒未満の場合は、2.0 ファミリーを使い続けてください。標準モデルは1080p にも対応しており、最高クラスの品質帯に位置します。コスト重視の一括生成には、標準単価の約半額で最速の生成が可能な mini を使用してください。2.0 ファミリーは廃止される予定はありません。エンドポイント、認証、リクエスト形式は世代間で同一で、グループも同じです。切り替え時に変更するフィールドは 1 つだけです:model。2.5 は 1080p に対応していますか?4k はどうですか?
2.5 は 1080p に対応していますか?4k はどうですか?
"resolution": "4k" を送信すると同期 400 が返されます(課金されません)。見落としやすい違いが 1 つあります。2.5 は 1080p を H.265(hvc1)としてエンコードしますが、480p と 720p では H.264(avc1)が使用されます。H.265 ファイルは小さくなりますが、古いプレーヤー、一部のブラウザー、特定の編集ソフトでは H.264 より安定して扱えない場合があります。1080p を配布する前に、後続のパイプラインでデコードできることを確認してください。2.5 で動画編集と動画延長を実行するにはどうすればよいですか?
2.5 で動画編集と動画延長を実行するにはどうすればよいですか?
content に参照動画を指定し、prompt で意図を表現すると実行されます。エラーを早期に検出できるよう、omni_reference_task_type を明示的に渡してください。- 動画編集:
omni_reference_task_type: "edit"、少なくとも 1 つのrole: "reference_video"、ratioはadaptive、durationは-1である必要があります。また、元の動画の長さは 4~30 秒でなければなりません。prompt には編集を表す動詞(追加、削除、消去、変更、置換)が必要です。出力のアスペクト比と長さは入力動画に従います。また、長さには小数を指定できます(実測では 16.709 秒の結果が返されました)。 - 動画延長:
omni_reference_task_type: "extend"。参照動画を指定し、ratioをadaptiveに設定します。prompt には延長を表す動詞(延長、継続)が必要です。
@video1、@image1 のように、渡した順序に従います。無効なパラメータの場合は、数分後にタスクが失敗するのではなく、送信時に 400 が返されます(InvalidParameter.TaskTypeConstraint)。2.5 の mov 出力形式は何に使用しますか?
2.5 の mov 出力形式は何に使用しますか?
"output_format": "mov" を渡すと、QuickTime コンテナ(H.264 + yuv444p クロマ + PCM オーディオ)が返され、色と輝度の再現性が向上します。これはカラーグレーディング、キーイング、コンポジットに適しており、動画編集/延長では入力と出力の両方に使用することが公式に推奨されています。デフォルトはmp4で、最も幅広い互換性があります。mov では、一部のプレーヤーで開けないプロフェッショナル向けコーデックが使用されることに注意してください(VLC、mpv、ffplay、macOS の IINA はすべて対応しています)。Web やモバイルで直接配信する場合は、デフォルトの mp4 を使用してください。「このモデルに利用可能なチャネルがありません」と表示されます。なぜですか?
「このモデルに利用可能なチャネルがありません」と表示されます。なぜですか?
SeeDance2 を有効にした 1 つのキーですべての 4 モデルにアクセスできます。課金モデルは「従量課金(優先)」または「従量課金」である必要もあります。リクエストごとの課金 Token ではルーティングできません。Python requests で gzip エラーが発生する/切り詰められた非 JSON 本文が返される
Python requests で gzip エラーが発生する/切り詰められた非 JSON 本文が返される
content-encoding: gzip ヘッダーが、実際の本文のエンコーディングと一致していません。症状には、ContentDecodingError、切り詰められた非 JSON 本文(例:先頭の {" が失われ、id":"cgt-xxx"} しか取得できない)、断続的な 400 などがあります。リクエストヘッダーに "Accept-Encoding": "identity" を追加してください。curl とブラウザーの fetch には影響ありません。動画に音声が付くのはなぜですか?オフにするにはどうすればよいですか?
動画に音声が付くのはなぜですか?オフにするにはどうすればよいですか?
generate_audio のデフォルトは true です(検証済み)。モデルが音声、効果音、BGM を自動的に追加します。無音の出力にするには、"generate_audio": false を明示的に渡してください。動画 URL はどこにありますか?また、なぜ使えなくなるのですか?
動画 URL はどこにありますか?また、なぜ使えなくなるのですか?
content.video_url にあります(トップレベルではありません)。これは約 24 時間有効な署名付きリンクです。すぐにダウンロードして、自分の環境で再ホストしてください。task_id 自体は 7 日間クエリ可能です。成功ステータスの値は何ですか?
成功ステータスの値は何ですか?
queued → running → succeeded / failed / expired です。成功状態は succeeded であり、completed ではありません。他の動画 API から移行する際によくある間違いです。実在する人物の写真を image-to-video にアップロードできますか?
実在する人物の写真を image-to-video にアップロードできますか?
asset:// ID)を使用する、またはライセンス済みの顔アセットを使用してください。アセットライブラリには追加料金がかかりますか?
アセットライブラリには追加料金がかかりますか?
失敗または拒否されたリクエストにも課金されますか?
失敗または拒否されたリクエストにも課金されますか?
token の使用量を見積もるにはどうすればよいですか?ポートレートは割高ですか?
token の使用量を見積もるにはどうすればよいですか?ポートレートは割高ですか?
tokens ≈ duration(s) × width × height × 24 / 1024です。誤差 0.1% 以内で検証済みです。1 つのティア内では、すべてのアスペクト比でピクセル面積が同じです(720p の 16:9 と 9:16 はどちらも 5 秒あたり 108,900 token)。横長、縦長、正方形の料金はすべて同じです。2.0 ファミリーでは、standard、fast、mini のどれを選ぶべきですか?
2.0 ファミリーでは、standard、fast、mini のどれを選ぶべきですか?
duration: -1 は何をしますか?
duration: -1 は何をしますか?
duration フィールドに返されます。2.5 では -1 がデフォルトであることに注意してください(2.0 ファミリーのデフォルトは 5 秒です)。そのため、duration を省略すると、モデルが選択する長さが使用されます。実測では、duration を指定しない 2.5 のリクエストから 10 秒のクリップが返され、5 秒の場合のちょうど 2 倍の料金になりました。料金を予測しやすくしたい場合は、duration を明示的に渡してください。frames パラメータは小数秒に対応していますか?
frames パラメータは小数秒に対応していますか?
frames と camera_fixed は Seedance 1.x のパラメータです。Seedance 2.5 も Seedance 2.0 シリーズも対応していません。代わりに、秒単位の整数の duration を使用してください。first+last frame、first frame、参照画像を組み合わせて使用できますか?
first+last frame、first frame、参照画像を組み合わせて使用できますか?
first_frame/last_frame のロールが必須の 2 枚の画像)、first frame(1 枚の画像)、マルチモーダルの reference-to-video(画像ロール reference_image)です。「first/last frame + reference」を近似するには、reference モードを使用し、prompt でフレームを指定してください。参照数の上限は世代によって異なります。2.5 は画像 30 枚、動画 10 本、音声クリップ 10 個に対応し、音声のみでも使用できます。2.0 ファミリーは画像 9 枚、動画 3 本、音声クリップ 3 個に対応し、音声を使用する場合は少なくとも画像 1 枚または動画 1 本も必要です。同時実行数の制限やキューはありますか?
同時実行数の制限やキューはありますか?
SeeDance2 グループは十分な同時実行数を備えており、キュー待ちはありません(テストでは 15 個のタスクを同時に実行し、すべて即時に開始されました)。より大規模な継続的ワークロードについては、営業にお問い合わせください。prompt に制限はありますか?
prompt に制限はありますか?
関連ドキュメント
- 動画生成 API リファレンスとプレイグラウンド -
POST /seedance/api/v3/contents/generations/tasks - アセット優先ワークフロー - メディアを含むリクエストで create-task を即座に返す方法と、タイムアウト後の対処方法
- VEO 3.1 動画生成 - Google公式動画チャンネル
- チャージボーナス - 実質コストは公式チャンネルとほぼ同等
- APIマニュアル - 一般的な呼び出し規則