간단 답변
동시 실행 수 제한은 모델 유형에 따라 다릅니다 - 텍스트 모델은 동시 실행 수가 가장 높고, 이미지 모델은 중간 수준의 제어가 있습니다.중요한 참고 사항동시 실행 수 제한은 개별 모델에 적용되며, 전체 계정에는 적용되지 않습니다. 예를 들어, Nano Banana Pro는 동시 요청 30개를 허용하며, 이는 다른 모델의 동시 실행 수에는 영향을 주지 않습니다.
모델 유형별 동시 실행 수 제한
텍스트 모델
기본값: 50 req/sec
- ✅ 높은 동시 실행 수 지원
- ✅ 배치 처리에 적합
- 🔓 더 높은 쿼터를 이용할 수 있습니다
비동기 동영상 모델
기본값: 높은 동시 실행 수
- ✅ 비동기 처리
- ✅ 대규모 호출 지원
- 📊 배치 동영상 생성에 적합
이미지 모델
기본값: 30 req/sec
- ⚠️ 동시 실행 수가 제어됩니다
- 📦 Base64 대용량 데이터 전송
- 🔓 요청 시 조정 가능합니다
이미지 모델에 동시 실행 수 제어가 필요한 이유는 무엇입니까?
동시 실행 수 계산 방식
개별 모델별
동시 실행 수 제한은 계정 전체가 아니라 각 특정 모델에 적용됩니다:더 높은 동시 실행 수를 요청하는 방법?
개인 사용자
1
필요 사항 평가
필요한 동시 실행 수 수준과 사용 사례를 정하십시오
2
지원팀 문의
기업 위챗으로 문의해 주십시오하여 필요 사항을 설명하십시오
3
기술 검토
사용 사례와 기존 데이터를 바탕으로 평가하겠습니다
4
쿼터 조정
승인되면 token의 동시 실행 수 제한을 조정하겠습니다
기업 고객
전용 회선 서비스기업 고객은 다음과 같은 전용 회선 서비스를 신청할 수 있습니다:
- 🚀 더 높은 동시 실행 수 쿼터: 비즈니스 요구에 맞춰 맞춤 설정됩니다
- 🔒 격리된 리소스 풀: 공용 트래픽의 영향을 받지 않습니다
- ⚡ 우선 스케줄링: 보장된 응답 속도
- 📞 전담 지원: 일대일 서비스
자주 묻는 질문
텍스트 모델의 동시 실행 수가 이미지 모델보다 높은 이유는 무엇입니까?
텍스트 모델의 동시 실행 수가 이미지 모델보다 높은 이유는 무엇입니까?
텍스트 모델은 요청/응답 payload가 더 작고(일반적으로 몇 KB 수준), 반면 이미지 모델은 Base64로 인코딩된 이미지 데이터를 전송합니다(일반적으로 500KB-5MB). 동시 실행 수 제어는 전체 서비스 품질을 보장합니다.
현재 동시 실행 수 쿼터는 어떻게 확인합니까?
현재 동시 실행 수 쿼터는 어떻게 확인합니까?
다음 방법으로 확인할 수 있습니다:
- 백엔드 콘솔 token 설정
- API 응답 헤더의 요청 제한 정보
- 구체적인 쿼터는 고객 서비스에 문의
동시 실행 수 제한을 초과하면 어떻게 됩니까?
동시 실행 수 제한을 초과하면 어떻게 됩니까?
제한을 초과하면 API는
429 Too Many Requests를 반환합니다. 권장 사항:- 요청 큐 관리 구현
- 재시도 메커니즘 추가(지수 백오프)
- 더 높은 동시 실행 수 쿼터 신청
다른 token 간에 동시 실행 수 제한이 공유됩니까?
다른 token 간에 동시 실행 수 제한이 공유됩니까?
아닙니다. 각 token은 간섭 없이 독립적인 동시 실행 수 쿼터를 가집니다. 총 동시 실행 수를 높이려면 여러 token을 생성하여 요청을 분산하십시오.
동시 실행 수 쿼터 조정에 추가 비용이 있습니까?
동시 실행 수 쿼터 조정에 추가 비용이 있습니까?
일반적으로 합리적인 동시 실행 수 조정은 무료입니다. 다만 매우 높은 동시 실행 수나 전용 회선 서비스는 기업 맞춤형 플랜이 필요할 수 있으므로, 자세한 내용은 고객 서비스에 문의하십시오.
동시 실행 수 최적화 팁
요청 큐 사용
동시 요청을 제어하고 요청 제한을 피하기 위해 로컬 큐 관리를 구현합니다
오류 재시도 메커니즘
429 오류가 발생하면 지수 백오프 재시도 전략을 사용합니다
여러 token 분산
여러 token을 생성해 요청을 서로 다른 token으로 분산하고, 총 동시 실행 수를 높입니다
비동기 처리 우선
실시간이 아닌 시나리오에서는 비동기 API(예: 동영상 생성)를 우선합니다
