Skip to main content

요청 사전 차감 메커니즘

APIYI는 요청 사전 차감 메커니즘을 사용하며, 요청을 전송할 때 예상 요금이 미리 차감됩니다. 현재 잔액이 요청을 지원하기에 부족하면, 계정에 일부 잔액이 있더라도 요청은 실패합니다.
사전 차감 설명시스템은 입력 내용의 복잡도를 기준으로 이 요청의 가능한 최대 비용을 추정합니다. 추정 비용이 현재 잔액을 초과하면 요청을 실행할 수 없습니다.

일반적인 원인 분석

1. 입력 콘텐츠 token 초과

이미지 콘텐츠
  • 복잡한 이미지(고해상도, 여러 이미지)를 업로드한 경우
  • 페이지 수가 많거나 복잡한 문서가 포함된 PDF
  • 차트, 스크린샷과 같은 시각 콘텐츠가 많은 경우
텍스트 콘텐츠
  • 서드파티 소프트웨어에서 웹 검색 플러그인을 활성화한 경우
  • 전체 코드베이스(여러 디렉터리와 파일)를 전달한 경우
  • 긴 문서나 많은 양의 코드

2. 모델 컨텍스트 한도 초과

이처럼 과도한 콘텐츠는 다음을 유발할 수 있습니다:
  • 현재 모델의 전체 컨텍스트를 초과함 (입력 + 출력 총합)
  • 현재 APIYI 잔액을 초과함
  • 요청 사전 차감 금액이 너무 높음
컨텍스트 계산모델 컨텍스트 한도 = 입력 token + 출력 token 총합예: 모델이 128K 컨텍스트를 지원하고 입력에 이미 100K tokens를 사용했다면, 출력은 최대 28K tokens까지 가능합니다.

해결 방법

1. 입력 콘텐츠 확인

입력 최적화
  • 이미지 크기를 압축하거나 줄입니다
  • 대용량 파일은 배치로 처리합니다
  • 불필요한 웹 검색 기능은 비활성화합니다
  • 전체 프로젝트가 아니라 관련된 코드 파일만 전달합니다
콘텐츠 분할
  • 긴 문서는 여러 부분으로 나눕니다
  • 여러 이미지는 배치로 업로드합니다
  • 코드 파일은 하나씩 처리합니다

2. 계정 잔액 확인

잔액 확인
  • 콘솔에 로그인하여 현재 잔액을 확인합니다
  • 예상 과금을 지불하기에 잔액이 충분한지 확인합니다
  • 더 여유 있는 잔액을 위해 충전을 고려합니다

3. 적절한 모델 선택

권장 테스트 모델
  • gpt-4o-mini - 저렴한 가격으로 테스트에 적합합니다
  • gpt-3.5-turbo - 저비용 옵션입니다
  • claude-3-haiku - 빠르고 경제적인 모델입니다
비용 최적화 제안먼저 더 저렴한 모델로 입력 콘텐츠를 테스트하여 적절한지 확인한 다음, 확인 후 더 상위 모델로 전환합니다.

4. 토큰 사용량 분석

토큰 계산 도구
  • 온라인 Token 계산기를 사용하여 콘텐츠 길이를 추정합니다
  • API 반환값에서 Token 사용 통계를 확인합니다
  • 서로 다른 콘텐츠의 Token 소모량을 비교합니다

기술 지원

위 방법을 따른 후에도 문제가 지속되면 기술 고객 서비스에 문의하여 도움을 받으십시오:

Enterprise WeChat

Enterprise WeChat QR 코드QR 코드를 스캔하거나 지원팀에 문의하려면 클릭하십시오빠른 진단을 위해 다음 정보를 제공해 주십시오:
  • 잔액 스크린샷
  • 입력 내용에 대한 일반적인 설명
  • 사용한 모델명
  • 오류 메시지 스크린샷

예방 조치

1. 콘텐츠 전처리

  • 전송 전에 콘텐츠 복잡도를 평가합니다
  • 압축 도구를 사용해 파일 크기를 최적화합니다
  • 전체 콘텐츠보다 핵심 정보를 추출합니다

2. 잔액 관리

  • 충분한 계정 잔액을 유지합니다
  • 잔액 알림 리마인더를 설정합니다
  • 소비 기록을 정기적으로 검토합니다

3. 모델 선택

  • 작업 복잡도에 따라 적절한 모델을 선택합니다
  • 간단한 작업에는 경제적인 모델을 사용합니다
  • 복잡한 작업에만 고급 모델을 고려합니다

일반적인 오류 메시지

  • Insufficient balance for this request - 잔액 부족
  • Input too long - 입력 내용이 너무 깁니다
  • Context length exceeded - 컨텍스트 한도를 초과했습니다
  • Request timeout - 요청 시간이 초과되었습니다(보통 내용이 너무 길기 때문입니다)