簡単な回答
同時実行数の制限はモデルの種類によって異なります - テキストモデルは同時実行数が最も多く、画像モデルは中程度の制御です。重要な注意同時実行数の制限は個々のモデルに適用され、アカウント全体には適用されません。たとえば、Nano Banana Pro には 30 件の同時リクエストがあり、他のモデルの同時実行数には影響しません。
モデル種別ごとの同時実行数制限
テキストモデル
デフォルト: 50 リクエスト/秒
- ✅ 高い同時実行に対応
- ✅ バッチ処理に適しています
- 🔓 より高いクォータを利用可能
非同期動画モデル
デフォルト: 高い同時実行数
- ✅ 非同期処理
- ✅ 大規模な呼び出しに対応
- 📊 バッチ動画生成に最適
画像モデル
デフォルト: 30 リクエスト/秒
- ⚠️ 同時実行数は制御されています
- 📦 Base64による大容量データ転送
- 🔓 リクエストに応じて調整可能
なぜ画像モデルには同時実行数の制御があるのでしょうか?
同時実行数の計算方法
個々のモデルごと
同時実行数の制限は、アカウント全体ではなく、各特定のモデルに適用されます。より高い同時実行数を申請するには?
個人ユーザー
1
必要条件の確認
必要な同時実行数とユースケースを確認します
2
サポートへの連絡
Enterprise WeChat でお問い合わせください כדי needs? to explain your needs
3
技術審査
ユースケースと過去データに基づいて評価します
4
クォータの調整
承認後、token の同時実行数制限を調整します
エンタープライズ顧客
専用回線サービスエンタープライズ顧客は、以下の特長を備えた専用回線サービスを申請できます:
- 🚀 より高い同時実行数クォータ: ビジネス要件に合わせてカスタマイズ
- 🔒 分離されたリソースプール: 一般トラフィックの影響を受けません
- ⚡ 優先スケジューリング: 応答速度を保証
- 📞 専任サポート: 1対1のサービス
よくある質問
なぜテキストモデルは画像モデルより同時実行数が高いのですか?
なぜテキストモデルは画像モデルより同時実行数が高いのですか?
テキストモデルはリクエスト/レスポンスのペイロードが小さく(通常は数 KB)、一方で画像モデルは Base64 エンコードされた画像データを転送します(通常は 500KB-5MB)。同時実行数の制御は、サービス全体の品質を確保するためのものです。
現在の同時実行数クォータはどのように確認できますか?
現在の同時実行数クォータはどのように確認できますか?
確認方法は次のとおりです:
- バックエンドコンソールの token 設定
- API レスポンスヘッダー内の レート制限 情報
- 具体的なクォータについてカスタマーサポートに問い合わせる
同時実行数制限を超えるとどうなりますか?
同時実行数制限を超えるとどうなりますか?
制限を超えると、API は
429 Too Many Requests を返します。推奨事項:- リクエストキュー管理を実装する
- リトライ機構(指数バックオフ)を追加する
- より高い同時実行数クォータを申請する
同時実行数制限は異なる token 間で共有されますか?
同時実行数制限は異なる token 間で共有されますか?
いいえ。各 token は干渉のない独立した同時実行数クォータを持ちます。合計の同時実行数を増やしたい場合は、複数の token を作成してリクエストを分散してください。
同時実行数クォータの調整に追加料金はかかりますか?
同時実行数クォータの調整に追加料金はかかりますか?
一般的に、妥当な同時実行数の調整は 無料 です。ただし、極めて高い同時実行数や専用回線サービスでは、法人向けのカスタムプランが必要になる場合があります - 詳細はカスタマーサポートにお問い合わせください。
同時実行数最適化のヒント
リクエストキューを使用
ローカルのキュー管理を実装して、同時リクエストを制御し、制限を回避します
エラー再試行メカニズム
429エラーが発生した場合は、指数バックオフの再試行戦略を使用します
複数 token の分散
複数の token を作成して、異なる token にリクエストを分散し、全体の同時実行数を増やします
非同期処理を優先
リアルタイムでないシナリオでは、非同期API(動画生成など)を優先します
