簡潔な回答
タイムアウト問題の90%をカバーする3つの黄金ルール:
- 同期型の画像生成エンドポイントには 360 秒のタイムアウトを設定します。 画像生成には非同期タスク ID がないため、早く切断すると課金はされるのに画像は取得できません。
- 推論モデルには十分な時間を与えます。
gemini-3.1-pro-preview、gpt-5.6-sol、gpt-5.5-proは、stream するかどうかに関係なく、数分かかることがあります。 - 長時間のリクエストを CDN ノード経由で実行しないでください。
api-cf.apiyi.comは Cloudflare の背後にあり、約 100 秒を超えると524を返します。高速なテキスト呼び出しにのみ適しています。
429(同時実行数不足)を返し続ける場合は、サポートに連絡してクォータを確認してもらってください。タイムアウト早見表
4つの要点を詳しく見る
① 同期型画像エンドポイント: タイムアウトを 360 秒に設定します
① 同期型画像エンドポイント: タイムアウトを 360 秒に設定します
APIYI の画像モデルはすべて同期型です。リクエストを送信し、接続を維持すると、結果はレスポンスボディで返ってきます。非同期タスク ID もポーリングエンドポイントもありません。切断すると結果は失われます。デフォルト設定が不利な理由: 一般的な HTTP クライアントは 30〜60 秒を既定値にしていますが、画像生成は実際にはかなり長いリクエストです。
- GPT-Image-2 を
high品質で 2K/4K にすると、実運用では 3〜5 分かかります - Nano Banana の 4K 生成は 50 秒前後から始まり、ピーク時にはさらに長くなります
- マルチ画像参照タスクは 5 分を超えることがよくあります
② 推論モデル: streaming の有無にかかわらず遅い
② 推論モデル: streaming の有無にかかわらず遅い
通常のテキストモデルは数秒で返るため、テキスト呼び出しにはタイムアウト調整が不要だと思いがちです。推論モデルは例外です:
gemini-3.1-pro-previewgpt-5.6-solgpt-5.5-pro(より高価で、より遅い)- 高い thinking budget で動作する任意のモデル
stream=True ならデータがすぐ届くと思いがちですが、推論モデルは考えている間に token をまったく出さないことがあるため、read timeout はそれでも発火します。さらに、最初の token から最後の token までの総時間も長いままです。推奨: 推論モデルのタイムアウトは 300〜600 秒 に設定し、確保した時間に合わせて thinking tier(reasoning_effort / thinking)を合わせてください。上位ティアほど余裕が必要です。③ ベース URL の選択: CDN ノードは長いリクエストをさばけません
③ ベース URL の選択: CDN ノードは長いリクエストをさばけません
APIYI の
api-cf.apiyi.com は Cloudflare のグローバル CDN の前段にあります。世界中で高速化でき、海外からの低レイテンシにも強い一方、リクエストのタイムアウトはおおむね 100 秒 で、それを超えると 524 エラーになります。⚠️ これは画像エンドポイントだけの問題ではありません。 100 秒を超える可能性がある呼び出しは、次のようなものも含めて相性がよくありません。- ❌ 画像生成 / 編集
- ❌ 動画生成
- ❌ 長いテキスト出力(長文記事、大規模な翻訳、大きなコード生成)
- ❌ 推論モデルでの深い推論タスク
api.apiyi.com(中国本土向けに推奨)または vip.apiyi.com(海外向けに推奨)を使ってください。各ノードの比較は Base URL ガイド にあります。④ 429 の同時実行数制限に当たる場合: サポートに連絡してください
④ 429 の同時実行数制限に当たる場合: サポートに連絡してください
タイムアウトと同時に頻繁な
429 Too Many Requests が発生する場合、問題はたいてい 同時実行数クォータ であり、タイムアウトではありません。同時実行数制限はアカウント全体ではなく、モデルごと に適用されます。特定のモデル、特に新しく公開されたものや供給が限られているものは、クォータが低い場合があります。対処方法:- 突発的に制限を使い切らないように、指数バックオフを実装します
- 429 が続く場合は、APIYI サポートに連絡してください。対象モデルの実際のクォータを確認し、調整をお手伝いできます
コード例
- Python
- Node.js
- cURL
タイムアウトを延長してもまだタイムアウトする場合は? 各ホップを確認してください
1
ステップ 1: SDK のタイムアウトが実際に適用されているか確認する
一部のフレームワークは、HTTP クライアントの周囲に別のタイムアウトを重ねます。有効な設定を出力し、変更したパラメータが実際に使われていることを確認してください。
2
ステップ 2: 経路上のすべてのホップを確認する
生成時間より短いタイムアウトを持つレイヤーは、クライアントより先に切断されます:
- 自己ホスト型リバースプロキシ: Nginx
proxy_read_timeout(既定では60秒) - クラウドロードバランサー: アイドル接続タイムアウト
- API ゲートウェイ / CDN: オリジンタイムアウト
- サーバーレス関数: 実行上限 (既定では多くの場合30〜60秒)
- タスクキューワーカー: タスクごとのタイムアウト
3
ステップ 3: CDN ノード上にいないことを確認する
ベース URL が
api-cf.apiyi.comか確認してください。長時間かかるリクエストでは、api.apiyi.comまたはvip.apiyi.comに切り替えてください。目安として、524 は、ほとんどの場合、遅いモデルではなく Cloudflare レイヤーのタイムアウトを意味します。4
ステップ 4: タイムアウトと同時実行数制限を区別する
ステータスコードを確認してください:
524 と切断された接続はタイムアウトの問題であり、429 はクォータの問題です。対処法はまったく異なります。5
ステップ 5: 実際のレイテンシーをコールログで確認する
コンソールの call logs で、そのリクエストの実際の所要時間と課金を確認し、そこから適切なタイムアウトを導き出してください。
よくある質問
タイムアウトしたリクエストの返金は受けられますか?
タイムアウトしたリクエストの返金は受けられますか?
いいえ。クライアントが切断されても、サーバーと上流側はジョブを最後まで完了するため、費用は実際に発生します。正しい対応は、小さな値で試してリトライに頼るのではなく、タイムアウトを最初から安全な上限まで一気に設定することです。リトライは請求額を増やすだけです。
切断後に ID で結果を取得できる非同期エンドポイントを提供できますか?
切断後に ID で結果を取得できる非同期エンドポイントを提供できますか?
画像エンドポイントは現在 同期パススルーモード で動作しており、当社ではお客様の業務データを保存しないため、切断後に ID で取得することはできません。推奨パターンは、同期呼び出し + 余裕のあるタイムアウト + 独自のタスク状態テーブルです。実質的には軽量な非同期キューです。画像エンドポイントは同期ですか、それとも非同期ですか?動画モデルは最初から非同期であり、これには影響されません。
ストリーミングはタイムアウトを防ぎますか?
ストリーミングはタイムアウトを防ぎますか?
一部はそうですが、頼り切らないでください。ストリーミングは最初の token をより早く返すため、完全な応答なしになるリスクを下げます。ただし reasoning モデルは思考フェーズ中に何も出力しない場合があり、その場合でも読み取りタイムアウトは発火しますし、全体の出力時間は結局同じくらいかかります。正しい対応は、ストリーミング に加えて 余裕のあるタイムアウトを設定することです。
非常に大きいタイムアウトを設定するデメリットはありますか?
非常に大きいタイムアウトを設定するデメリットはありますか?
課金への影響はありません。課金されるのは消費した token と呼び出しであり、待った時間ではありません。懸念があるのはお客様側のリソース使用だけです。長い接続はワーカーまたはコネクションプールのスロットを占有します。同時実行数が多い場合は、画像生成と reasoning リクエストを async IO か専用の長時間タスクキューで処理してください。
524 と 429 の違いは何ですか?
524 と 429 の違いは何ですか?
524: Cloudflare レイヤーのタイムアウトで、api-cf.apiyi.comを使っており、リクエストが約 100 秒を超えたことを意味します。ノードを切り替えてください。429: 同時実行数または rate limit によるもので、所要時間とは関係ありません。指数バックオフを追加し、継続する場合はサポートへ連絡してください。
関連ドキュメント
Image APIのベストプラクティス
モデルごとのタイムアウト表と出力形式のリファレンス
Base URL はどのように設定しますか?
4つのノードの違いと選び方
画像エンドポイントは同期ですか、それとも非同期ですか?
同期モードとクライアント側のタスク管理
どの程度の同時実行数を使えますか?
モデル種別ごとの同時実行数の制限とクォータ申請
お問い合わせ
WeCom サポート
メール
サポート: [email protected]営業: [email protected]
