간단 답변
동시 실행 수 제한은 모델 유형에 따라 다릅니다 - 텍스트 모델은 동시 실행 수가 가장 높고, 이미지 모델은 중간 수준의 제어가 있습니다.중요한 참고 사항동시 실행 수 제한은 개별 모델에 적용되며, 전체 계정에는 적용되지 않습니다. 예를 들어, Nano Banana Pro는 동시 요청 30개를 허용하며, 이는 다른 모델의 동시 실행 수에는 영향을 주지 않습니다.
모델 유형별 동시 실행 수 제한
텍스트 모델
기본값: 50 req/sec
- ✅ 높은 동시 실행 수 지원
- ✅ 배치 처리에 적합
- 🔓 더 높은 쿼터를 이용할 수 있습니다
비동기 동영상 모델
기본값: 높은 동시 실행 수
- ✅ 비동기 처리
- ✅ 대규모 호출 지원
- 📊 배치 동영상 생성에 적합
이미지 모델
기본값: 30 req/sec
- ⚠️ 동시 실행 수가 제어됩니다
- 📦 Base64 대용량 데이터 전송
- 🔓 요청 시 조정 가능합니다
이미지 모델에 동시 실행 수 제어가 필요한 이유는 무엇입니까?
동시 실행 수 계산 방식
개별 모델별
동시 실행 수 제한은 계정 전체가 아니라 각 특정 모델에 적용됩니다:더 높은 동시 실행 수를 요청하는 방법?
개인 사용자
1
필요 사항 평가
필요한 동시 실행 수 수준과 사용 사례를 정하십시오
2
지원팀 문의
기업 위챗으로 문의해 주십시오하여 필요 사항을 설명하십시오
3
기술 검토
사용 사례와 기존 데이터를 바탕으로 평가하겠습니다
4
쿼터 조정
승인되면 token의 동시 실행 수 제한을 조정하겠습니다
기업 고객
전용 회선 서비스기업 고객은 다음과 같은 전용 회선 서비스를 신청할 수 있습니다:
- 🚀 더 높은 동시 실행 수 쿼터: 비즈니스 요구에 맞춰 맞춤 설정됩니다
- 🔒 격리된 리소스 풀: 공용 트래픽의 영향을 받지 않습니다
- ⚡ 우선 스케줄링: 보장된 응답 속도
- 📞 전담 지원: 일대일 서비스
자주 묻는 질문
텍스트 모델의 동시 실행 수가 이미지 모델보다 높은 이유는 무엇입니까?
텍스트 모델의 동시 실행 수가 이미지 모델보다 높은 이유는 무엇입니까?
텍스트 모델은 요청/응답 payload가 더 작고(일반적으로 몇 KB 수준), 반면 이미지 모델은 Base64로 인코딩된 이미지 데이터를 전송합니다(일반적으로 500KB-5MB). 동시 실행 수 제어는 전체 서비스 품질을 보장합니다.
현재 동시 실행 수 쿼터는 어떻게 확인합니까?
현재 동시 실행 수 쿼터는 어떻게 확인합니까?
다음 방법으로 확인할 수 있습니다:
- 백엔드 콘솔 token 설정
- API 응답 헤더의 요청 제한 정보
- 구체적인 쿼터는 고객 서비스에 문의
동시 실행 수 제한을 초과하면 어떻게 됩니까?
동시 실행 수 제한을 초과하면 어떻게 됩니까?
제한을 초과하면 API는
429 Too Many Requests를 반환합니다. 권장 사항:- 요청 큐 관리 구현
- 재시도 메커니즘 추가(지수 백오프)
- 더 높은 동시 실행 수 쿼터 신청
다른 token 간에 동시 실행 수 제한이 공유됩니까?
다른 token 간에 동시 실행 수 제한이 공유됩니까?
아닙니다. 각 token은 간섭 없이 독립적인 동시 실행 수 쿼터를 가집니다. 총 동시 실행 수를 높이려면 여러 token을 생성하여 요청을 분산하십시오.
동시 실행 수 쿼터 조정에 추가 비용이 있습니까?
동시 실행 수 쿼터 조정에 추가 비용이 있습니까?
일반적으로 합리적인 동시 실행 수 조정은 무료입니다. 다만 매우 높은 동시 실행 수나 전용 회선 서비스는 기업 맞춤형 플랜이 필요할 수 있으므로, 자세한 내용은 고객 서비스에 문의하십시오.
동시 실행 수 최적화 팁
요청 큐 사용
로컬 큐 관리를 구현하여 동시 요청을 제어하고 제한을 피합니다
오류 재시도 메커니즘
429 오류가 발생하면 지수 백오프 재시도 전략을 사용합니다
여러 token 분산
여러 token을 생성하여 요청을 서로 다른 token에 분산하고 전체 동시 실행 수를 늘립니다
비동기 처리 우선
실시간이 아닌 시나리오에서는 비동기 API(예: 동영상 생성)를 우선 사용합니다
