簡潔な回答
HTTPステータスコードだけでリクエストを診断しないでください。まず完全なエラー、モデル名、ベースURL、tokenグループ、リクエストIDを保存し、その後、問題がリクエスト設定エラーなのか、一時的な上流障害なのかを判断してください。400、401、403、未サポートのパラメーター、安全性ブロック、グループの不一致には、通常、リクエストまたは設定の変更が必要です。同じリクエストを繰り返しても解決しません。429、503、一部の504レスポンス、Upstream model timed outは、上流の負荷、リソースの可用性、または長時間実行されるリクエストが原因で発生する場合があります。ログを確認してから、制限付きの指数バックオフリトライを使用してください。- 1つのモデルまたはグループだけが失敗する場合は、認証済みのフォールバックグループをテストしてください。複数のモデルが同時に失敗する場合は、まずAPIキー、ベースURL、ネットワーク経路を確認してください。
完全なエラーを保存する
スクリーンショットでは、最も有用なフィールドが省略されることがよくあります。トラブルシューティングの前に、次の情報を保存してください。エラーの種類別トラブルシューティング
同じステータスコードでも、原因が異なる場合があります。たとえば、
429 は上流の飽和を意味する場合がありますが、完全なエラーメッセージにのみ詳細が表示されるリクエスト互換性の問題である可能性もあります。最終的な根拠として、レスポンスボディと呼び出しログを使用してください。標準的なトラブルシューティング手順
1
手順1:最小限のリクエストで再現する
オプションパラメータ、ツール定義、複雑な画像入力、長い prompt を一時的に削除します。モデル、必須メッセージ、認証情報だけを残します。これにより、リクエストエラーとルートまたはモデルのエラーを切り分けられます。
2
手順2:エンドポイント、token、グループを確認する
API キーが
api.apiyi.com ベースURL とともに使用されていることを確認します。コンソールで、token のプライマリグループ、フォールバックグループ、使用可能なモデルを確認します。一部のモデルでは専用グループが必要です。3
手順3:リトライが適切かどうかを判断する
429、503、および一時的なアップストリーム障害が確認された場合は、バックオフ付きリトライを使用します。パラメータエラー、安全性ブロック、無効なモデル名、グループの不一致の場合は、変更していないリクエストをリトライするのではなく、リクエストまたは設定を変更します。4
手順4:タイムアウトとネットワーク経路を確認する
画像生成、推論モデル、長いテキストリクエストには、より長いタイムアウトが必要です。約100秒の制限がある
api-cf.apiyi.com CDN ノードではなく、長いリクエストには api.apiyi.com または vip.apiyi.com を使用します。5
手順5:再送信する前に呼び出しログを確認する
リクエストによって課金レコードが作成されたかどうかを確認します。クライアント側のタイムアウトや切断は、サーバー側の処理が停止したことを必ずしも意味しません。ステータスを確認する前に、リクエストを無条件に再送信することは避けてください。
最小テストリクエスト
次のリクエストを使用して、エンドポイント、token、基本的なモデル呼び出しを確認します。YOUR_MODELを、お使いのtokenで利用可能なモデルに置き換え、最小限の呼び出しが機能するまでオプションフィールドを追加しないでください。
繰り返し発生するエラーを防ぐ
- 最小限のリクエストから始め、
stop、tools、推論制御、画像、その他のオプションフィールドを一度に1つずつ追加します。 - すべてのモデルが同じフィールドをサポートすると想定せず、モデルごとのパラメータ互換性テーブルを管理します。
429の後に、多数の同時実行リクエストをすぐに再送しないでください。指数バックオフを使用し、モデルごとに同時実行数を制御します。- 画像および推論のリクエストには、十分なタイムアウトを設定します。SDKのリトライと独自のビジネスレイヤーのリトライを重ねないでください。
- 実際の本番パラメータでテスト済みのフォールバックグループを設定します。
よくある質問
429 は常に同時実行数が多すぎることを意味しますか?
429 は常に同時実行数が多すぎることを意味しますか?
いいえ。
429 は同時実行数または上流サービスの飽和が原因で発生する可能性がありますが、エラーメッセージにパラメータ互換性の問題が隠れている場合もあります。同時実行数を下げるかリクエストを変更するかを判断する前に、完全な error.message を確認してください。401 の後は常に新しい token を作成する必要がありますか?
401 の後は常に新しい token を作成する必要がありますか?
いいえ。まず、リクエストで APIYI のベース URL が使用されていることを確認し、次に token の有効期限が切れていないか、正しいグループが選択されているかを確認してください。1 つのモデルだけが 5xx またはタイムアウトエラーとともに
Invalid token を返す場合は、上流ルートが原因である可能性もあります。タイムアウトの直後にリトライできますか?
タイムアウトの直後にリトライできますか?
まず呼び出しログを確認してください。クライアントのタイムアウトは、クライアントが待機を停止したことを意味するだけであり、サーバー側の処理は継続している可能性があります。リクエストに課金記録がある場合、すぐにリトライすると重複した呼び出しが発生する可能性があります。
失敗したリクエストにも課金されますか?
失敗したリクエストにも課金されますか?
エラーページだけを根拠に判断しないでください。モデル生成に到達しないパラメータ検証、認証、安全性によるブロックでは、通常、最終的な課金は発生しません。ただし、クライアントの切断や、上流サービスでの処理がすでに開始されたリクエストには、課金される可能性があります。正確な情報源として呼び出しログを使用してください。
まだ解決しませんか?サポートにお問い合わせください
上記の手順を実行しても問題が解決しない場合は、WeComまたはメールでAPIYIサポートにお問い合わせください。トラブルシューティングを迅速に進めるため、以下の情報を含めてください。- モデル名、tokenグループ、ベース URL
- 完全なエラーメッセージ、HTTPステータス、リクエストID
- 発生日時(
UTC+8のタイムゾーンを含む) - 最小化したリクエスト例、または機密情報を伏せたリクエストボディ
- 呼び出しログに課金記録が含まれているかどうか
WeComサポート
QRコードをスキャンするか、このカードをクリックしてサポートに直接お問い合わせください。モデルエラー、タイムアウト、グループ、課金に関する問題
メールサポート
サポート: [email protected]件名には「モデルエラー」とモデル名を含めることをおすすめします。
関連ドキュメント
APIキーが無効なのはなぜですか?
ベースURL、APIキー、認証設定を確認します
グループとは何ですか?
tokenグループ、アップストリームルート、フォールバックグループについて説明します
リクエストのタイムアウトを回避するにはどうすればよいですか?
タイムアウト、ノード、長時間リクエストのトラブルシューティングを設定します
どの程度の同時実行数を利用できますか?
モデルの同時実行数制限と429に関する案内を確認します
サイトまたはAPIが502を返した場合はどうすればよいですか?
5xxエラー、再試行、課金の確認について説明します
ログの課金額はどのように読み取ればよいですか?
呼び出しログを使用して、リクエストに課金されたかどうかを確認します