簡潔な回答
タイムアウト問題の90%をカバーする3つの黄金ルール:
- 同期型の画像生成エンドポイントには 360 秒のタイムアウトを設定します。 画像生成には非同期タスク ID がないため、早く切断すると課金はされるのに画像は取得できません。
- 推論モデルには十分な時間を与えます。
gemini-3.1-pro-preview、gpt-5.6-sol、gpt-5.5-proは、stream するかどうかに関係なく、数分かかることがあります。 - 長時間のリクエストを CDN ノード経由で実行しないでください。
api-cf.apiyi.comは Cloudflare の背後にあり、約 100 秒を超えると524を返します。高速なテキスト呼び出しにのみ適しています。
429(同時実行数不足)を返し続ける場合は、サポートに連絡してクォータを確認してもらってください。タイムアウト早見表
4つのポイントを詳しく
① 同期画像エンドポイント: タイムアウトを360秒に設定する
① 同期画像エンドポイント: タイムアウトを360秒に設定する
APIYIの画像モデルはすべて同期型です: リクエストを送信し、接続を維持すると、結果はレスポンスボディで返ってきます。非同期のtask IDやポーリング用エンドポイントはありません — 切断すると結果は失われます。なぜデフォルト値では困るのか: 一般的なHTTPクライアントのデフォルトは30〜60秒ですが、画像生成は本当に長いリクエストです:
- GPT-Image-2 at
highquality with 2K/4K takes 3-5 minutes in practice - Nano Banana 4K generation starts around 50 seconds and runs longer at peak
- Multi-image reference tasks often exceed 5 minutes
② 推論モデル: ストリーミングの有無にかかわらず遅い
② 推論モデル: ストリーミングの有無にかかわらず遅い
通常のテキストモデルは数秒で返るため、テキスト呼び出しではタイムアウト調整が不要だと思いがちです。推論モデルは例外です:
gemini-3.1-pro-previewgpt-5.6-solgpt-5.5-pro(より高価で、より遅い)- 高いthinkingBudget(高いreasoning_effort)で動作する任意のモデル
stream=Trueならデータがすぐに届くと思いがちですが、推論モデルは思考フェーズ中にtokenをまったく出力しないことがあるため、読み取りタイムアウトはそれでも発生します — そして、最初のtokenから最後のtokenまでの総時間はやはり長いままです。推奨: 推論モデルには300〜600秒のタイムアウトを設定し、許容できる時間に合わせてthinkingBudgetの段階(reasoning_effort / thinking)を選んでください — より高い段階ほど、より大きな余裕が必要です。③ ベースURLの選択: CDNノードでは長時間リクエストを処理できません
③ ベースURLの選択: CDNノードでは長時間リクエストを処理できません
APIYIの
api-cf.apiyi.comはCloudflareのグローバルCDNの前段にあります。海外からの高速化と低レイテンシを提供しますが、約100秒のリクエストタイムアウトがあり、それを超えると524エラーになります。⚠️ これは画像エンドポイントだけの話ではありません。 100秒を超える可能性がある呼び出しは、次のようにすべて相性がよくありません:- ❌ 画像生成 / 編集
- ❌ 動画生成
- ❌ 長文出力(長い記事、大規模翻訳、大きなコード生成)
- ❌ 推論モデルでの深い思考タスク
api.apiyi.com(中国本土で推奨)またはvip.apiyi.com(海外で推奨)を使用してください。ノードの完全比較は ベースURLガイド をご覧ください。④ 429の同時実行数制限に達した場合: サポートに連絡
④ 429の同時実行数制限に達した場合: サポートに連絡
タイムアウトに加えて
429 Too Many Requestsが頻発する場合、問題はたいてい同時実行数クォータであり、タイムアウトではありません。同時実行数制限はアカウント全体ではなく、モデルごとに適用されます。特定のモデル — とくに新しくリリースされたものや供給が限られているもの — は、クォータが低い場合があります。対応方法:- バーストで制限を飽和させないよう、指数バックオフを実装する
- 429が続く場合は、APIYIサポートに連絡してください — こちらでそのモデルの実際のクォータを確認し、調整をお手伝いできます
コード例
- Python
- Node.js
- cURL
タイムアウトを延長してもまだタイムアウトする場合は? 各ホップを確認してください
1
ステップ 1: SDK のタイムアウトが実際に適用されているか確認する
一部のフレームワークは、HTTP クライアントの周囲に別のタイムアウトを重ねます。有効な設定を出力し、変更したパラメータが実際に使われていることを確認してください。
2
ステップ 2: 経路上のすべてのホップを確認する
生成時間より短いタイムアウトを持つレイヤーは、クライアントより先に切断されます:
- 自己ホスト型リバースプロキシ: Nginx
proxy_read_timeout(既定では60秒) - クラウドロードバランサー: アイドル接続タイムアウト
- API ゲートウェイ / CDN: オリジンタイムアウト
- サーバーレス関数: 実行上限 (既定では多くの場合30〜60秒)
- タスクキューワーカー: タスクごとのタイムアウト
3
ステップ 3: CDN ノード上にいないことを確認する
ベース URL が
api-cf.apiyi.comか確認してください。長時間かかるリクエストでは、api.apiyi.comまたはvip.apiyi.comに切り替えてください。目安として、524 は、ほとんどの場合、遅いモデルではなく Cloudflare レイヤーのタイムアウトを意味します。4
ステップ 4: タイムアウトと同時実行数制限を区別する
ステータスコードを確認してください:
524 と切断された接続はタイムアウトの問題であり、429 はクォータの問題です。対処法はまったく異なります。5
ステップ 5: 実際のレイテンシーをコールログで確認する
コンソールの call logs で、そのリクエストの実際の所要時間と課金を確認し、そこから適切なタイムアウトを導き出してください。
よくある質問
タイムアウトしたリクエストの返金は受けられますか?
タイムアウトしたリクエストの返金は受けられますか?
いいえ。クライアントが切断されても、サーバーと上流側はジョブを最後まで完了するため、費用は実際に発生します。正しい対応は、小さな値で試してリトライに頼るのではなく、タイムアウトを最初から安全な上限まで一気に設定することです。リトライは請求額を増やすだけです。
切断後に ID で結果を取得できる非同期エンドポイントを提供できますか?
切断後に ID で結果を取得できる非同期エンドポイントを提供できますか?
画像エンドポイントは現在 同期パススルーモード で動作しており、当社ではお客様の業務データを保存しないため、切断後に ID で取得することはできません。推奨パターンは、同期呼び出し + 余裕のあるタイムアウト + 独自のタスク状態テーブルです。実質的には軽量な非同期キューです。画像エンドポイントは同期ですか、それとも非同期ですか?動画モデルは最初から非同期であり、これには影響されません。
ストリーミングはタイムアウトを防ぎますか?
ストリーミングはタイムアウトを防ぎますか?
一部はそうですが、頼り切らないでください。ストリーミングは最初の token をより早く返すため、完全な応答なしになるリスクを下げます。ただし reasoning モデルは思考フェーズ中に何も出力しない場合があり、その場合でも読み取りタイムアウトは発火しますし、全体の出力時間は結局同じくらいかかります。正しい対応は、ストリーミング に加えて 余裕のあるタイムアウトを設定することです。
非常に大きいタイムアウトを設定するデメリットはありますか?
非常に大きいタイムアウトを設定するデメリットはありますか?
課金への影響はありません。課金されるのは消費した token と呼び出しであり、待った時間ではありません。懸念があるのはお客様側のリソース使用だけです。長い接続はワーカーまたはコネクションプールのスロットを占有します。同時実行数が多い場合は、画像生成と reasoning リクエストを async IO か専用の長時間タスクキューで処理してください。
524 と 429 の違いは何ですか?
524 と 429 の違いは何ですか?
524: Cloudflare レイヤーのタイムアウトで、api-cf.apiyi.comを使っており、リクエストが約 100 秒を超えたことを意味します。ノードを切り替えてください。429: 同時実行数または rate limit によるもので、所要時間とは関係ありません。指数バックオフを追加し、継続する場合はサポートへ連絡してください。
関連ドキュメント
Image APIのベストプラクティス
モデルごとのタイムアウト表と出力形式のリファレンス
Base URL はどのように設定しますか?
4つのノードの違いと選び方
画像エンドポイントは同期ですか、それとも非同期ですか?
同期モードとクライアント側のタスク管理
どの程度の同時実行数を使えますか?
モデル種別ごとの同時実行数の制限とクォータ申請
お問い合わせ
WeCom サポート
メール
サポート: [email protected]営業: [email protected]
