Skip to main content

リクエスト事前差し引き機構

APIYIはリクエスト事前差し引き機構を使用しており、リクエスト送信時に見積もり料金が事前に差し引かれます。現在の残高がリクエストを支えるのに不十分な場合、アカウントに多少の残高があっても、リクエストは失敗します。
事前差し引きの説明システムは、入力内容の複雑さに基づいて、このリクエストの最大想定コストを見積もります。見積もりコストが現在の残高を超える場合、リクエストは実行できません。

主な原因の分析

1. 入力コンテンツの token 超過

画像コンテンツ
  • 複雑な画像をアップロードした場合(高解像度、複数画像)
  • 多数のページを含む PDF や複雑なドキュメント
  • チャートやスクリーンショットのような視覚コンテンツが豊富な場合
テキストコンテンツ
  • サードパーティ製ソフトウェアで Web 検索プラグインを有効にした場合
  • コードベース全体を渡した場合(複数のディレクトリとファイル)
  • 長文ドキュメントや大量のコード

2. モデルのコンテキスト制限を超過

このような過剰なコンテンツにより、次のことが発生する場合があります:
  • 現在のモデル全体のコンテキストを超過する(入力 + 出力の合計)
  • 現在の APIYI 残高を超過する
  • リクエストの事前差し引き額が高すぎる
コンテキストの計算モデルのコンテキスト制限 = 入力 token + 出力 token の合計例: あるモデルが 128K のコンテキストをサポートしており、入力ですでに 100K token を使用している場合、出力は最大 28K token までです。

解決策

1. 入力内容を確認する

入力を最適化する
  • 画像サイズを圧縮または縮小する
  • 大きなファイルはバッチで処理する
  • 不要な web 検索機能を無効にする
  • プロジェクト全体ではなく、関連するコードファイルだけを渡す
内容の分割
  • 長い文書は複数の部分に分割する
  • 複数の画像はバッチでアップロードする
  • コードファイルは1つずつ処理する

2. 残高を確認する

残高の確認
  • コンソールにログインして現在の残高を確認する
  • 見積もり料金を支払えるだけの残高があることを確認する
  • より十分な残高にするためにチャージを検討する

3. 適切なモデルを選択する

推奨テストモデル
  • gpt-4o-mini - 低価格で、テストに適しています
  • gpt-3.5-turbo - 低コストの選択肢です
  • claude-3-haiku - 高速で経済的なモデルです
コスト最適化の提案まずは安価なモデルで入力内容をテストして妥当性を確認し、その後、確認できてから上位モデルに切り替えてください。

4. token 使用量を分析する

token 計算ツール
  • オンラインの token 計算ツールを使って内容の長さを見積もる
  • API の返却値から token 使用量の統計を確認する
  • 異なる内容の token 消費量を比較する

技術サポート

上記の方法を試しても問題が解決しない場合は、技術カスタマーサポートまでお問い合わせください。

企業WeChat

企業WeChatのQRコードQRコードをスキャンするか、サポートに連絡するにはこちらをクリックしてください迅速に診断するため、以下の情報をご提供ください:
  • アカウント残高のスクリーンショット
  • 入力内容の概要
  • 使用したモデル名
  • エラーメッセージのスクリーンショット

予防策

1. コンテンツの前処理

  • 送信する前にコンテンツの複雑さを評価する
  • 圧縮ツールを使ってファイルサイズを最適化する
  • 全文ではなく、重要な情報を抽出する

2. 残高管理

  • 十分なアカウント残高を維持する
  • 残高アラートのリマインダーを設定する
  • 消費記録を定期的に確認する

3. モデルの選択

  • タスクの複雑さに応じて適切なモデルを選択する
  • 単純なタスクには低コストのモデルを使う
  • 高度なモデルは複雑なタスクにのみ検討する

よくあるエラーメッセージ

  • Insufficient balance for this request - 残高不足
  • Input too long - 入力内容が長すぎます
  • Context length exceeded - コンテキスト制限を超えました
  • Request timeout - リクエストがタイムアウトしました(通常はコンテンツが長すぎるためです)