Skip to main content

簡潔な回答

タイムアウト問題の90%をカバーする3つの黄金ルール:
  1. 同期型の画像生成エンドポイントには 360 秒のタイムアウトを設定します。 画像生成には非同期タスク ID がないため、早く切断すると課金はされるのに画像は取得できません。
  2. 推論モデルには十分な時間を与えます。 gemini-3.1-pro-previewgpt-5.6-solgpt-5.5-pro は、stream するかどうかに関係なく、数分かかることがあります。
  3. 長時間のリクエストを CDN ノード経由で実行しないでください。 api-cf.apiyi.com は Cloudflare の背後にあり、約 100 秒を超えると 524 を返します。高速なテキスト呼び出しにのみ適しています。
別件ですが、特定のモデルが 429(同時実行数不足)を返し続ける場合は、サポートに連絡してクォータを確認してもらってください。

タイムアウト早見表

タイムアウトしたリクエストも課金されますクライアントが切断された後も、サーバーと上流プロバイダーは処理を最後まで完了し、そのリクエストは通常どおり課金されます言い換えると、タイムアウトを低く設定しすぎると、料金を払って何も得られません。もう少しで成功するリクエストが自分のクライアント側で切られないように、まずは安全な上限値を設定してください。

4つの要点を詳しく見る

APIYI の画像モデルはすべて同期型です。リクエストを送信し、接続を維持すると、結果はレスポンスボディで返ってきます。非同期タスク ID もポーリングエンドポイントもありません。切断すると結果は失われます。デフォルト設定が不利な理由: 一般的な HTTP クライアントは 30〜60 秒を既定値にしていますが、画像生成は実際にはかなり長いリクエストです。
  • GPT-Image-2 を high 品質で 2K/4K にすると、実運用では 3〜5 分かかります
  • Nano Banana の 4K 生成は 50 秒前後から始まり、ピーク時にはさらに長くなります
  • マルチ画像参照タスクは 5 分を超えることがよくあります
推奨: モデルのレイテンシが不明な場合は、まず 360 秒 を基準にしてください。4K やマルチ画像参照のような重いタスクには 600 秒 を与えます。モデルごとの値は Image API best practices にあります。
ログ上では画像が 30 秒で完了しているのに、クライアントは 5 分待っていた、ということが時々あります。これは上流側がレスポンス末尾を保持していたことによるもので、通常のばらつきの範囲です。十分に余裕のあるタイムアウトを設定していれば、それでも画像は取得できます。
通常のテキストモデルは数秒で返るため、テキスト呼び出しにはタイムアウト調整が不要だと思いがちです。推論モデルは例外です:
  • gemini-3.1-pro-preview
  • gpt-5.6-sol
  • gpt-5.5-pro(より高価で、より遅い)
  • 高い thinking budget で動作する任意のモデル
これらのモデルは回答を生成する前に内部で長時間考えるため、合計レイテンシが数分になるのは普通です重要: streaming では解決できません。 多くの人は stream=True ならデータがすぐ届くと思いがちですが、推論モデルは考えている間に token をまったく出さないことがあるため、read timeout はそれでも発火します。さらに、最初の token から最後の token までの時間も長いままです。推奨: 推論モデルのタイムアウトは 300〜600 秒 に設定し、確保した時間に合わせて thinking tier(reasoning_effort / thinking)を合わせてください。上位ティアほど余裕が必要です。
APIYI の api-cf.apiyi.comCloudflare のグローバル CDN の前段にあります。世界中で高速化でき、海外からの低レイテンシにも強い一方、リクエストのタイムアウトはおおむね 100 秒 で、それを超えると 524 エラーになります。⚠️ これは画像エンドポイントだけの問題ではありません。 100 秒を超える可能性がある呼び出しは、次のようなものも含めて相性がよくありません。
  • ❌ 画像生成 / 編集
  • ❌ 動画生成
  • ❌ 長いテキスト出力(長文記事、大規模な翻訳、大きなコード生成)
  • ❌ 推論モデルでの深い推論タスク
適しているもの: 100 秒以内に完了する通常のチャットや短い生成です。推奨: 長時間のリクエストには api.apiyi.com(中国本土向けに推奨)または vip.apiyi.com(海外向けに推奨)を使ってください。各ノードの比較は Base URL ガイド にあります。
タイムアウトと同時に頻繁な 429 Too Many Requests が発生する場合、問題はたいてい 同時実行数クォータ であり、タイムアウトではありません。同時実行数制限はアカウント全体ではなく、モデルごと に適用されます。特定のモデル、特に新しく公開されたものや供給が限られているものは、クォータが低い場合があります。対処方法:
  1. 突発的に制限を使い切らないように、指数バックオフを実装します
  2. 429 が続く場合は、APIYI サポートに連絡してください。対象モデルの実際のクォータを確認し、調整をお手伝いできます
ルールは どのくらいの同時実行数を使えますか? をご覧ください。

コード例

長時間のリクエストで自動再試行に注意してください: 多くの SDK はデフォルトで 2 回再試行します。画像生成や推論タスクがタイムアウトして再試行されると、何も得られないまま 3 回分課金される可能性があります。max_retries を 0 に設定し、再試行はご自身のアプリケーションロジックで制御してください。

タイムアウトを延長してもまだタイムアウトする場合は? 各ホップを確認してください

1

ステップ 1: SDK のタイムアウトが実際に適用されているか確認する

一部のフレームワークは、HTTP クライアントの周囲に別のタイムアウトを重ねます。有効な設定を出力し、変更したパラメータが実際に使われていることを確認してください。
2

ステップ 2: 経路上のすべてのホップを確認する

生成時間より短いタイムアウトを持つレイヤーは、クライアントより先に切断されます:
  • 自己ホスト型リバースプロキシ: Nginx proxy_read_timeout (既定では60秒)
  • クラウドロードバランサー: アイドル接続タイムアウト
  • API ゲートウェイ / CDN: オリジンタイムアウト
  • サーバーレス関数: 実行上限 (既定では多くの場合30〜60秒)
  • タスクキューワーカー: タスクごとのタイムアウト
すべてのホップでタイムアウトを広げる必要があります — クライアントだけを変更しても何も変わりません。
3

ステップ 3: CDN ノード上にいないことを確認する

ベース URL がapi-cf.apiyi.comか確認してください。長時間かかるリクエストでは、api.apiyi.comまたはvip.apiyi.comに切り替えてください。目安として、524 は、ほとんどの場合、遅いモデルではなく Cloudflare レイヤーのタイムアウトを意味します。
4

ステップ 4: タイムアウトと同時実行数制限を区別する

ステータスコードを確認してください: 524 と切断された接続はタイムアウトの問題であり、429 はクォータの問題です。対処法はまったく異なります。
5

ステップ 5: 実際のレイテンシーをコールログで確認する

コンソールの call logs で、そのリクエストの実際の所要時間と課金を確認し、そこから適切なタイムアウトを導き出してください。

よくある質問

いいえ。クライアントが切断されても、サーバーと上流側はジョブを最後まで完了するため、費用は実際に発生します。正しい対応は、小さな値で試してリトライに頼るのではなく、タイムアウトを最初から安全な上限まで一気に設定することです。リトライは請求額を増やすだけです。
画像エンドポイントは現在 同期パススルーモード で動作しており、当社ではお客様の業務データを保存しないため、切断後に ID で取得することはできません。推奨パターンは、同期呼び出し + 余裕のあるタイムアウト + 独自のタスク状態テーブルです。実質的には軽量な非同期キューです。画像エンドポイントは同期ですか、それとも非同期ですか?動画モデルは最初から非同期であり、これには影響されません。
一部はそうですが、頼り切らないでください。ストリーミングは最初の token をより早く返すため、完全な応答なしになるリスクを下げます。ただし reasoning モデルは思考フェーズ中に何も出力しない場合があり、その場合でも読み取りタイムアウトは発火しますし、全体の出力時間は結局同じくらいかかります。正しい対応は、ストリーミング に加えて 余裕のあるタイムアウトを設定することです。
課金への影響はありません。課金されるのは消費した token と呼び出しであり、待った時間ではありません。懸念があるのはお客様側のリソース使用だけです。長い接続はワーカーまたはコネクションプールのスロットを占有します。同時実行数が多い場合は、画像生成と reasoning リクエストを async IO か専用の長時間タスクキューで処理してください。
  • 524: Cloudflare レイヤーのタイムアウトで、api-cf.apiyi.com を使っており、リクエストが約 100 秒を超えたことを意味します。ノードを切り替えてください。
  • 429: 同時実行数または rate limit によるもので、所要時間とは関係ありません。指数バックオフを追加し、継続する場合はサポートへ連絡してください。

関連ドキュメント

Image APIのベストプラクティス

モデルごとのタイムアウト表と出力形式のリファレンス

Base URL はどのように設定しますか?

4つのノードの違いと選び方

画像エンドポイントは同期ですか、それとも非同期ですか?

同期モードとクライアント側のタスク管理

どの程度の同時実行数を使えますか?

モデル種別ごとの同時実行数の制限とクォータ申請

お問い合わせ

WeCom サポート

WeCom サポートのQRコードQRコードをスキャンするか、クリックしてサポートに連絡タイムアウトのトラブルシューティングと同時実行数クォータの申請

メール