Skip to main content

簡単な回答

同時実行数の制限はモデルの種類によって異なります - テキストモデルは同時実行数が最も多く、画像モデルは中程度の制御です。
重要な注意同時実行数の制限は個々のモデルに適用され、アカウント全体には適用されません。たとえば、Nano Banana Pro には 30 件の同時リクエストがあり、他のモデルの同時実行数には影響しません。

モデル種別ごとの同時実行数制限

テキストモデル

デフォルト: 50 リクエスト/秒
  • ✅ 高い同時実行に対応
  • ✅ バッチ処理に適しています
  • 🔓 より高いクォータを利用可能

非同期動画モデル

デフォルト: 高い同時実行数
  • ✅ 非同期処理
  • ✅ 大規模な呼び出しに対応
  • 📊 バッチ動画生成に最適

画像モデル

デフォルト: 30 リクエスト/秒
  • ⚠️ 同時実行数は制御されています
  • 📦 Base64による大容量データ転送
  • 🔓 リクエストに応じて調整可能

なぜ画像モデルには同時実行数の制御があるのでしょうか?

技術的な理由画像生成 API は画像データを転送するために Base64 エンコーディング を使用するため、リクエストのペイロードが大きくなります(通常、1リクエストあたり 500KB〜5MB)。サービスの安定性と応答速度を確保するため、適度な同時実行数の制御が必要です。: Nano Banana Pro のデフォルト同時リクエスト数は 30 で、ほとんどのユースケースに十分です。

同時実行数の計算方法

個々のモデルごと

同時実行数の制限は、アカウント全体ではなく、各特定のモデルに適用されます。
実例次のものを同時に使用する場合:
  • Nano Banana Pro(画像): 30 同時実行
  • GPT-4o mini(テキスト): 50 同時実行
  • FLUX.1 Pro(画像): 30 同時実行
利用可能な同時実行数の合計: 110+ リクエスト(モデルごとに独立)

より高い同時実行数を申請するには?

個人ユーザー

1

必要条件の確認

必要な同時実行数とユースケースを確認します
2

サポートへの連絡

Enterprise WeChat でお問い合わせください כדי needs? to explain your needs
3

技術審査

ユースケースと過去データに基づいて評価します
4

クォータの調整

承認後、token の同時実行数制限を調整します

エンタープライズ顧客

専用回線サービスエンタープライズ顧客は、以下の特長を備えた専用回線サービスを申請できます:
  • 🚀 より高い同時実行数クォータ: ビジネス要件に合わせてカスタマイズ
  • 🔒 分離されたリソースプール: 一般トラフィックの影響を受けません
  • 優先スケジューリング: 応答速度を保証
  • 📞 専任サポート: 1対1のサービス
エンタープライズ向けサービスプランについてはお問い合わせください。

よくある質問

テキストモデルはリクエスト/レスポンスのペイロードが小さく(通常は数 KB)、一方で画像モデルは Base64 エンコードされた画像データを転送します(通常は 500KB-5MB)。同時実行数の制御は、サービス全体の品質を確保するためのものです。
確認方法は次のとおりです:
  • バックエンドコンソールの token 設定
  • API レスポンスヘッダー内の レート制限 情報
  • 具体的なクォータについてカスタマーサポートに問い合わせる
制限を超えると、API は 429 Too Many Requests を返します。推奨事項:
  • リクエストキュー管理を実装する
  • リトライ機構(指数バックオフ)を追加する
  • より高い同時実行数クォータを申請する
いいえ。各 token は干渉のない独立した同時実行数クォータを持ちます。合計の同時実行数を増やしたい場合は、複数の token を作成してリクエストを分散してください。
一般的に、妥当な同時実行数の調整は 無料 です。ただし、極めて高い同時実行数や専用回線サービスでは、法人向けのカスタムプランが必要になる場合があります - 詳細はカスタマーサポートにお問い合わせください。

同時実行数最適化のヒント

リクエストキューを使用

ローカルのキュー管理を実装して、同時リクエストを制御し、制限を回避します

エラー再試行メカニズム

429エラーが発生した場合は、指数バックオフの再試行戦略を使用します

複数 token の分散

複数の token を作成して、異なる token にリクエストを分散し、全体の同時実行数を増やします

非同期処理を優先

リアルタイムでないシナリオでは、非同期API(動画生成など)を優先します

お問い合わせ

より高い同時実行数クォータのご依頼や、エンタープライズ専用回線サービスについてのお問い合わせは、以下をご利用ください。

メールサポート

[email protected]同時実行数のご要望を詳しくご記入ください

エンタープライズ WeChat

エンタープライズ WeChat QRコードQRコードをスキャンするか、サポートに連絡する迅速な対応、リアルタイムでのコミュニケーション

Telegram

@apiyi001即時メッセージ、効率的な回答
お問い合わせ時にご提供ください:
  • 📊 利用ケース: 具体的なアプリケーション(例: ECサイトのバッチ画像生成、コンテンツモデレーション)
  • 📈 想定同時実行数: 必要な同時実行レベル
  • 🕐 ピーク時間帯: 主な利用時間帯
  • 📜 過去データ: 現在の呼び出し量と頻度
この情報により、お客様に最適な同時実行数クォータプランをご提案できます。