リクエスト事前差し引き機構
APIYIはリクエスト事前差し引き機構を使用しており、リクエスト送信時に見積もり料金が事前に差し引かれます。現在の残高がリクエストを支えるのに不十分な場合、アカウントに多少の残高があっても、リクエストは失敗します。主な原因の分析
1. 入力コンテンツの token 超過
画像コンテンツ- 複雑な画像をアップロードした場合(高解像度、複数画像)
- 多数のページを含む PDF や複雑なドキュメント
- チャートやスクリーンショットのような視覚コンテンツが豊富な場合
- サードパーティ製ソフトウェアで Web 検索プラグインを有効にした場合
- コードベース全体を渡した場合(複数のディレクトリとファイル)
- 長文ドキュメントや大量のコード
2. モデルのコンテキスト制限を超過
このような過剰なコンテンツにより、次のことが発生する場合があります:- 現在のモデル全体のコンテキストを超過する(入力 + 出力の合計)
- 現在の APIYI 残高を超過する
- リクエストの事前差し引き額が高すぎる
コンテキストの計算モデルのコンテキスト制限 = 入力 token + 出力 token の合計例: あるモデルが 128K のコンテキストをサポートしており、入力ですでに 100K token を使用している場合、出力は最大 28K token までです。
解決策
1. 入力内容を確認する
入力を最適化する- 画像サイズを圧縮または縮小する
- 大きなファイルはバッチで処理する
- 不要な web 検索機能を無効にする
- プロジェクト全体ではなく、関連するコードファイルだけを渡す
- 長い文書は複数の部分に分割する
- 複数の画像はバッチでアップロードする
- コードファイルは1つずつ処理する
2. 残高を確認する
残高の確認- コンソールにログインして現在の残高を確認する
- 見積もり料金を支払えるだけの残高があることを確認する
- より十分な残高にするためにチャージを検討する
3. 適切なモデルを選択する
推奨テストモデルgpt-4o-mini- 低価格で、テストに適していますgpt-3.5-turbo- 低コストの選択肢ですclaude-3-haiku- 高速で経済的なモデルです
4. token 使用量を分析する
token 計算ツール- オンラインの token 計算ツールを使って内容の長さを見積もる
- API の返却値から token 使用量の統計を確認する
- 異なる内容の token 消費量を比較する
技術サポート
上記の方法を試しても問題が解決しない場合は、技術カスタマーサポートまでお問い合わせください。企業WeChat

- アカウント残高のスクリーンショット
- 入力内容の概要
- 使用したモデル名
- エラーメッセージのスクリーンショット
予防策
1. コンテンツの前処理
- 送信する前にコンテンツの複雑さを評価する
- 圧縮ツールを使ってファイルサイズを最適化する
- 全文ではなく、重要な情報を抽出する
2. 残高管理
- 十分なアカウント残高を維持する
- 残高アラートのリマインダーを設定する
- 消費記録を定期的に確認する
3. モデルの選択
- タスクの複雑さに応じて適切なモデルを選択する
- 単純なタスクには低コストのモデルを使う
- 高度なモデルは複雑なタスクにのみ検討する
よくあるエラーメッセージ
Insufficient balance for this request- 残高不足Input too long- 入力内容が長すぎますContext length exceeded- コンテキスト制限を超えましたRequest timeout- リクエストがタイムアウトしました(通常はコンテンツが長すぎるためです)