간단한 답변
권장 설정: 토큰을 생성할 때는 대부분의 시나리오에 적합한 “사용량 우선” 과금 모드를 선택합니다.

5가지 과금 방식 설명
1. 사용량 기반 과금(Token 기반)
정의: 입력과 출력에 대한 토큰 수를 기준으로 과금하며, 사용한 만큼 지불합니다. 적용 가능한 모델:- 텍스트 생성 모델: GPT-4, Claude, Gemini, DeepSeek 등
- 멀티모달 이해 모델: 이미지/오디오 입력을 지원하는 모델
- 특수 이미지 모델:
gpt-image-1(토큰 기준 과금)
gpt-4o: 입력 $5/백만 tokens, 출력 $15/백만 tokensclaude-3-5-sonnet-20241022: 입력 $3/백만 tokens, 출력 $15/백만 tokens
2. 호출당 과금
정의: 호출 1회당 고정 요금이 부과되며, 입력과 출력 토큰의 영향을 받지 않습니다. 적용 가능한 모델:- 이미지 생성 모델: DALL-E, Flux, Sora Image 등 (gpt-image-1 제외)
- 동영상 생성 모델: Sora Video, VEO 등
gemini-3-pro-image-preview(별칭nano-banana-pro): $0.09/호출sora_video2: $0.15/호출 (10초 동영상)flux-1.1-pro: $0.04/호출
호출당 과금의 장점:
- 투명한 요금 체계, 생성 1회당 고정 비용
- 토큰 소모량을 계산할 필요가 없음
- 이미지/동영상처럼 고정 출력 시나리오에 적합함
3. 하이브리드 과금
정의: 사용량 기반 과금과 호출당 과금을 모두 지원하며, 모델에 따라 자동으로 선택됩니다. 상태: ⚠️ 적용 불가4. 사용량 기반 우선 과금(권장)
정의: 모델이 두 방식을 모두 지원할 경우 사용량 기반 과금을 우선 적용하는 스마트 과금 모드이며, 모델이 호출당 과금만 지원하면 자동으로 전환됩니다. 권장 이유:- ✅ 호출당 과금 포함: 호출당 요금이 부과되는 이미지/동영상 모델을 호출할 수 있습니다
- ✅ 사용량 기반 과금 포함: 사용량 기준으로 과금되는 텍스트/멀티모달 모델을 호출할 수 있습니다
- ✅ 자동 적응: 시스템이 가장 적합한 과금 방식을 자동으로 선택합니다
- ✅ 모든 시나리오 커버: 지원되는 400개 이상의 모든 모델을 포괄합니다
권장 이유: “사용량 기반 우선 과금” 토큰을 사용하면, 서로 다른 과금 방식마다 별도의 토큰을 만들지 않고도 모든 모델을 호출할 수 있습니다.
5. 호출당 우선 과금
정의: 모델이 두 방식을 모두 지원할 경우 호출당 과금을 우선 적용하며, 모델이 사용량 기반 과금만 지원하면 자동으로 전환됩니다. 적용 시나리오:- 고정 비용이 필요한 시나리오
- 주로 이미지/동영상 생성 모델을 사용하는 경우
사용 권장: 명확한 비용 통제 요구가 없다면, 텍스트 모델은 일반적으로 사용량 기반 과금이 더 비용 효율적이므로 “사용량 기반 우선 과금”을 사용하십시오.
과금 모드를 선택하는 방법은?
권장 솔루션(사용자 95%에 적합)
사용량 기반 우선(기본 권장)
적용 시나리오:
- 텍스트, 이미지, 동영상 모델을 동시에 사용하는 경우
- 모델마다 서로 다른 token을 만들고 싶지 않은 경우
- 최대한의 유연성이 필요한 경우
- 400개 이상의 모든 모델을 지원합니다
- 시스템이 최적의 과금 방식을 자동으로 선택합니다
- 추가 설정이 필요하지 않습니다
특수 시나리오
- 순수 텍스트 애플리케이션
- 순수 이미지/동영상 애플리케이션
- 비용 제어
시나리오: GPT, Claude, Gemini 및 기타 텍스트 모델만 사용하는 경우권장 과금 모드: 사용량 기반 우선 또는 사용량 기반이유: 텍스트 모델은 모두 사용량 기반 과금을 사용하므로 두 모드의 효과가 같습니다
자주 묻는 질문
왜 gpt-image-1은 pay-per-use token을 요구합니까?
왜 gpt-image-1은 pay-per-use token을 요구합니까?
gpt-image-1은 OpenAI의 공식 이미지 생성 모델입니다. 이미지를 생성하지만, 과금 방식은 텍스트 모델과 비슷하며, Tokens 기준으로 과금됩니다.과금 요인:- 이미지 해상도 (1024x1024는 약 5000 token을 소비하며, 1792x1024는 약 8500 token을 소비합니다)
- 이미지 품질 (HD 품질은 Token 소모를 증가시킵니다)
- “Pay-per-Use Priority” 또는 “Pay-per-Use” token을 사용합니다
- “Pay-per-Call” token을 사용하면
gpt-image-1호출이 불가능합니다
이미 pay-per-call token을 만들었는데, pay-per-use priority로 변경할 수 있습니까?
이미 pay-per-call token을 만들었는데, pay-per-use priority로 변경할 수 있습니까?
네, 수정할 수 있습니다. 절차는 다음과 같습니다:
- API.YI 토큰 관리 페이지에 로그인합니다
- 해당 token을 찾아 오른쪽의 “Edit” 버튼을 클릭합니다
- “Billing Mode” 드롭다운 메뉴에서 “Pay-per-Use Priority”를 선택합니다
- 구성을 저장합니다
pay-per-use priority와 pay-per-call priority의 차이는 무엇입니까?
pay-per-use priority와 pay-per-call priority의 차이는 무엇입니까?
우선순위가 다릅니다:
권장 사항: 대부분의 경우 “Pay-per-Use Priority”를 사용합니다.
잘못된 과금 방식을 선택하면 호출에 실패합니까?
잘못된 과금 방식을 선택하면 호출에 실패합니까?
즉시 실패하지는 않지만, 일부 모델은 호출할 수 없을 수 있습니다.예시 시나리오:
- token이 “Pay-per-Call”인 경우,
gpt-4o호출은 실패합니다 (gpt-4o는 pay-per-use 과금만 지원하기 때문입니다) - token이 “Pay-per-Use”인 경우,
gemini-3-pro-image-preview호출은 실패할 수 있습니다 (이 모델은 pay-per-call 과금만 지원하기 때문입니다)
하이브리드 과금은 왜 적용되지 않습니까?
하이브리드 과금은 왜 적용되지 않습니까?
하이브리드 과금은 이론적으로 pay-per-use와 pay-per-call을 모두 지원하지만, 실제로는 다음과 같은 문제가 생길 수 있습니다:
- 과금 로직이 불명확해집니다
- 비용 예측이 어렵습니다
- 시스템 호환성 문제가 발생할 수 있습니다
요약 권장 사항
모범 사례: token을 생성할 때는 모든 사용 시나리오를 포괄하면서 모델별로 서로 다른 token을 만들 필요가 없도록 “사용량 기반 우선” 과금 모드를 선택하십시오.