size 매개변수를 다시 사용할 수 있습니다 (업데이트 2026-07-22): size를 명시적으로 전달하면 이제 예상대로 출력 크기가 잠기며, 이 페이지의 30개 크기 참조 표도 다시 적용됩니다. 참고: size는 /v1/images/generations 및 /v1/images/edits 엔드포인트에서만 동작합니다 — /v1/chat/completions 채팅 엔드포인트는 size 매개변수를 지원하지 않으므로, 채팅 기반 이미지 생성에서는 크기를 잠글 수 없습니다. 최신 상태는 실시간 업데이트 섹션을 참조하십시오.개요
gpt-image-2-vip은 Codex 라인의 GPT 이미지 생성 역공학 모델이며, APIYI 플랫폼에서 사용할 수 있습니다.gpt-image-2-all와 동일한 정액 $0.03/image이며 요청/응답 형식도 동일합니다. 단 하나의 의미 있는 차이는 vip가 size 필드를 **30개의 공통 크기(10개 가로세로 비율 × 3개 해상도 계층: 1K Fast / 2K Recommended / 4K Detail)**와 함께 지원한다는 점이며, 여기에는 4K도 포함됩니다.
gpt-image-2-vip를 사용합니다(이커머스 히어로 샷, 포스터 템플릿, 동영상 썸네일, 4K 월페이퍼 등). model 필드를 gpt-image-2-vip로 바꾸고 size 필드를 추가하기만 하면 되며, 나머지 코드 줄은 모두 gpt-image-2-all와 동일합니다.Text-to-Image API
/v1/images/generations — 명시적인 출력 차원을 위한 텍스트 prompt + size입니다.Image Editing API
/v1/images/edits — 편집/융합 지침이 포함된 multipart 업로드입니다.gpt-image-2-all과의 주요 차이점
gpt-image-2-vip과 gpt-image-2-all는 둘 다 역공학된 채널이며, 가격도 같고 호출 코드도 같습니다. 서로를 그대로 반영합니다 — 같은 요청에서 model 필드만 바꾸면 동작은 대체로 동일합니다. 차이점은 다음과 같습니다:
핵심 기능
출력 크기 고정
size 필드는 30가지 일반 크기를 지원합니다 — 전자상거래 히어로 이미지, 포스터 템플릿, 4K 배경화면을 모두 정확한 픽셀로 출력합니다.4K 고해상도
모든 크기에 동일한 요금
-all과 동일한 호출 형식
gpt-image-2-all과 동일합니다 — model 문자열만으로 모델을 전환할 수 있습니다.고품질 텍스트 렌더링
중국어 Prompt 친화적
자연어 편집
표준 엔드포인트 지원
/images/generations 및 /images/edits와 호환됩니다가격
- 모든 30개 크기에 대해 이미지당 $0.03 정액 — 4K Detail에 추가 요금이 없습니다
- 실패한 요청은 과금되지 않습니다(인증 실패, 매개변수 검증 오류)
- N개의 이미지를 처리하려면 API를 N번 병렬로 호출하십시오
그룹 설정
gpt-image-2-vip는 Default 그룹에 있습니다 — 추가 그룹이 필요하지 않습니다. 역방향 채널은 현재 안정적인 공급을 유지하고 있으므로, 공식 릴레이 gpt-image-2처럼 엔터프라이즈 그룹 폴백 이야기가 없습니다.
결정적인 URL 출력을 원하면 → image2_OSS 그룹으로 전환하십시오
2026년 7월 기본 그룹에서 측정한 결과, gpt-image-2-vip(및 gpt-image-2-all)은 response_format이 생략되면 b64_json를 반환합니다. 이미지 URL을 얻으려면 response_format: "url"를 명시적으로 전달하십시오. 기본 그룹의 출력 형식은 보장되지 않습니다 — 역사적으로는 url를 기본값으로 사용하고 과부하 시 b64_json로 폴백했으며, 채널 버전마다 변경되어 왔습니다.
귀사의 비즈니스가 URL 출력에 의존하는 경우(URL을 데이터베이스에 그대로 저장하거나, 프런트엔드에서 URL로 렌더링해야 하며, base64는 허용되지 않는 경우), token의 그룹을 **image2_OSS**로 변경하십시오 — 결정적인 URL 출력을 위해 특별히 설계된, **1배 요율 배수(추가 요금 없음)**의 그룹이며, 역방향 모델 gpt-image-2-vip 및 gpt-image-2-all 모두에 적용됩니다. 응답에 항상 이미지 URL이 포함되며 base64로 폴백하지 않습니다.

Token creation: set billing mode to "pay-as-you-go first" and pick the image2_OSS group (1x) — use it when you need deterministic URL output
image2Enterprise 그룹 소개: /en/live/2026-04/image2-enterprise-stable
기술 사양
엔드포인트
gpt-image-2-vip는 gpt-image-2-all와 완전히 동일한 두 엔드포인트와 호환됩니다. 필요하면 model 필드만 바꾸고 size를 추가하면 됩니다:
지원되는 크기(전체 30개 크기 표)
gpt-image-2-vip는 10개 종횡비 × 3개 해상도 티어 = 30개 크기를 지원합니다. size: "WIDTHxHEIGHT"(소문자 ASCII x)를 요청 본문에 직접 전달합니다.
1K Fast — 초안 및 저비용 반복 작업
2K Recommended — 기본 티어(대부분의 프로덕션 출력)
4K Detail — 대형 산출물
size만 전달하고, quality은 전달하지 마세요):
권장 사항
입력 이미지를 1.5MB 미만으로 압축합니다(이미지 편집 / 다중 이미지 융합)
shell_api_error / Unknown error 응답은 대부분 너무 큰 입력 때문에 발생하며, 압축하면 성공률과 지연 시간이 눈에 띄게 향상됩니다. 출력 해상도는 입력 크기가 아니라 size 필드에 의해 결정됩니다 — 입력을 줄여도 속도만 빨라질 뿐 품질은 저하되지 않습니다. 프롬프트에 4K / 8K를 잔뜩 넣어도 4K 이미지는 생성되지 않습니다. 해상도는 프롬프트의 군더더기가 아니라 size에 의해 설정됩니다.산출물에 맞춰 크기 등급을 선택합니다
크기에는 소문자 ASCII x를 사용합니다
"size": "1536x1024"를 보내십시오 — 1536×1024가 아니며, 대문자 X도 아닙니다.quality 또는 n을 전달하지 마십시오
quality는 거부됩니다. n는 호출당 1개 이미지만 반환하므로, 여러 이미지는 병렬로 호출하십시오.300s 타임아웃을 사용합니다
필요에 따라 응답 형식을 선택합니다
b64_json을 사용하고; 서버 측 저장/전달에는 url을 사용합니다.-all로 코드를 공유합니다
model를 gpt-image-2-all와 gpt-image-2-vip 사이에서 전환하십시오. 고정 크기가 필요할 때는 vip를 사용하고, 가장 빠른 반복을 위해 다시 -all로 전환하십시오.오류 코드 및 재시도
- 요청 타임아웃은 300초부터 설정하십시오 (보수적 기준; 일반적으로는 90–150s이지만 4K Detail + 피크 꼬리 구간에서는 더 길어집니다)
- 5xx 및 타임아웃에는 지수 백오프를 사용하십시오 (2–3회 재시도 권장)
- 디버깅을 위해
request-id응답 헤더를 기록하십시오
자주 묻는 질문
vip와 -all 사이에서 코드를 공유할 수 있습니까?
vip와 -all 사이에서 코드를 공유할 수 있습니까?
/v1/images/generations, /v1/images/edits)는 요청 필드, 응답 필드, 그리고 b64_json 접두사 동작을 공유합니다. 차이점은 두 가지뿐입니다.model필드:gpt-image-2-vip↔gpt-image-2-allsize필드: vip는 30개 사이즈 세트를 허용하고, -all은size를 거부합니다(사이즈는 대신 prompt에 들어갑니다)
if model == 'vip': payload['size'] = ... 스위치 하나로 단일 코드베이스를 유지하십시오.왜 vip가 그렇게 더 느립니까?
왜 vip가 그렇게 더 느립니까?
gpt-image-2-vip는 Codex 역방향 채널을 사용합니다 — 일반적으로 90~150초이며, 공식 gpt-image-2(100gpt-image-2-all(30gpt-image-2-all를 선호하십시오. 고정 사이즈나 4K가 필요할 때만 vip로 전환하십시오.사이즈는 반드시 표에 있는 값이어야 합니까? 1024x768을 보내면 어떻게 됩니까?
사이즈는 반드시 표에 있는 값이어야 합니까? 1024x768을 보내면 어떻게 됩니까?
invalid_request_error를 유발할 수 있습니다. 결과물에 가장 가까운 등급을 선택하십시오.왜 4K에서 500이 자주 반환됩니까? 안정적인 4K를 얻으려면 어떻게 해야 합니까?
왜 4K에서 500이 자주 반환됩니까? 안정적인 4K를 얻으려면 어떻게 해야 합니까?
3840x2160 / 2880x2880)에서는 status_code: 500 오류가 더 쉽게 발생하며, 상위 시스템은 invalid_request_error를 반환합니다.- 2K Recommended를 우선 사용(예:
2048x1360/2048x2048) — 성공률이 크게 높고, 비용은 동일하게 $0.03/image입니다 - img2img / 다중 이미지 융합에서는 입력 이미지 수를 줄이십시오 — Codex 역방향 채널은 입력 부하가 크면 더 취약해져 4K 실패율이 더 올라가며, 각 입력 이미지를 1.5MB 미만으로 미리 압축하는 것도 도움이 됩니다
- 4K를 보장하려면 공식 프록시
gpt-image-2+image2Enterprise그룹으로 전환하십시오. 공식 프록시 4K는 더 비싸지만(약 $0.3+/image), 훨씬 더 안정적입니다 — 4K 전달이 반드시 필요할 때 적합합니다.
입력 이미지를 압축해야 합니까? prompt에 4K / 8K를 적으면 도움이 됩니까?
입력 이미지를 압축해야 합니까? prompt에 4K / 8K를 적으면 도움이 됩니까?
shell_api_error / Unknown error 응답은 대부분 너무 큰 입력에서 발생하며, 압축하면 성공률과 지연 시간이 눈에 띄게 개선됩니다. 참고: 1.5MB는 신뢰성과 속도를 위한 권장 상한이며, 위 FAQ의 10MB 수치는 게이트웨이의 하드 한계입니다.압축이 품질을 해친다고 걱정할 필요는 없습니다 — 출력 해상도는 size 파라미터로 결정되며, 입력 크기와는 무관합니다. 입력을 줄이면 속도만 빨라집니다.4K / 8K를 prompt에 넣는다고 실제로 4K 출력이 나오지는 않습니다. prompt에 8K ultra HD라고 적어도 size를 1024x1024로 설정하면 여전히 1K 품질 이미지를 받습니다. 4K가 필요하면 size 필드에 설정하십시오 — 30개 사이즈 세트에서는 1K / 2K / 4K 모두 동일하게 고정 $0.03/image입니다.📖 출처: /en/live/2026-05/gpt-image-2-vip-unknown-error4K에 정말 추가 과금이 없습니까?
4K에 정말 추가 과금이 없습니까?
3840x2160 / 2880x2880 등)은 1K 및 2K와 동일하게 $0.03/image입니다.n을 지원합니까? n=3을 전달하면 어떻게 됩니까?
n을 지원합니까? n=3을 전달하면 어떻게 됩니까?
n=3를 전달하면 과금은 0.03 × 3 = $0.09이지만, 실제로는 1장만 반환됩니다. 낭비되는 과금을 피하려면 n 필드를 제거하십시오.콘텐츠가 거부되거나 모델이 'I can't do that'라고 답하면 과금됩니까?
콘텐츠가 거부되거나 모델이 'I can't do that'라고 답하면 과금됩니까?
- ✅ 사용자 사전 필터링 및 경고: 프론트엔드나 게이트웨이에 키워드/시나리오 필터(실존 인물 이름, 저작권 캐릭터, 민감 주제)를 추가하고, “Celebrity / IP 주제는 실패할 수 있으며 상위 정책에 따라 과금될 수도 있습니다.” 같은 UI 힌트를 보여주십시오. 이렇게 하면 낭비되는 과금을 크게 줄일 수 있습니다.
- ✅ 소비자용 제품의 월별 보전: 소비자 대상 제품은 사용자 입력을 완전히 차단할 수 없다는 점을 이해합니다. 월 지출이 충분히 크다면($1000+/month), 로그를 월 단위로 묶어 제출할 수 있으며(짧은 지연 시간 호출은 보통 soft refusal입니다) 지원팀에 일회성 수동 크레딧을 요청할 수 있습니다 — 호출별 이의 제기를 할 필요는 없습니다.
b64_json에 data:image/png;base64, prefix를 추가해야 합니까?
b64_json에 data:image/png;base64, prefix를 추가해야 합니까?
b64_json는 data: prefix가 없는 원시 base64입니다. 파일로 쓰려면 디코딩하고, 렌더링 전에 직접 prefix를 붙이십시오. 이전 버전에는 prefix가 포함되어 있었습니다. 코드에 startsWith('data:') 검사를 추가하십시오: prefix가 있으면 값을 그대로 img src로 사용하고, 없으면 먼저 디코딩하거나 prefix를 붙이십시오. 이렇게 하면 prefix를 두 번 붙이거나, prefix가 붙은 문자열을 디코딩해 깨진 이미지를 만드는 일을 피할 수 있습니다.참조 이미지의 최대 크기와 지원 형식은 무엇입니까?
참조 이미지의 최대 크기와 지원 형식은 무엇입니까?
png / jpg / webp입니다. 너무 큰 이미지는 게이트웨이 한도에 걸릴 수 있습니다. 다중 이미지 융합의 각 이미지는 이 제한을 충족해야 합니다.반환된 이미지 URL은 얼마나 오래 유효합니까? 다운로드해야 합니까?
반환된 이미지 URL은 얼마나 오래 유효합니까? 다운로드해야 합니까?
url-mode 응답의 url 필드는 약 1일(24시간) 후 만료되는 R2 CDN 링크입니다 — 그 이후의 요청은 404가 됩니다.강력히 권장합니다: 생성 직후 이미지를 자신의 object storage(S3 / OSS / R2), CDN 또는 데이터베이스에 다운로드하여 보관하십시오.스트리밍을 지원합니까?
스트리밍을 지원합니까?
"생성 중..." 진행 표시를 보여 주고, 300초 타임아웃을 설정하십시오(보수적 설정).공식 OpenAI SDK를 사용할 수 있습니까?
공식 OpenAI SDK를 사용할 수 있습니까?
base_url를 https://api.apiyi.com/v1로 지정하고, api_key를 APIYI token으로 설정하십시오. client.images.generate(model="gpt-image-2-vip", size="2048x1360", prompt=...)은 그대로 작동합니다./v1/chat/completions로 여전히 이미지를 생성할 수 있습니까?
/v1/chat/completions로 여전히 이미지를 생성할 수 있습니까?
/v1/images/generations와 /v1/images/edits를 사용하십시오(더 안정적이며, 공식 릴레이 gpt-image-2와도 같은 코드가 작동합니다).채팅 기반 스타일은 두 가지 경우에만 의미가 있습니다. 다회차 반복 편집 또는 온라인 이미지 URL 직접 전달입니다. 이미지 의도가 모호하면 모델이 이미지 대신 일반 텍스트를 반환할 수 있습니다(이를 강화하려면 prompt 앞에 “이미지를 생성하십시오:” 같은 고정 prefix를 붙이십시오).전체 파라미터는 채팅 기반 API 참조를 보십시오.언제 공식 gpt-image-2로 전환해야 합니까?
언제 공식 gpt-image-2로 전환해야 합니까?
quality 조절값(low/medium/high), 마스크 기반 로컬 재페인팅, 또는 엄격한 OpenAI API 필드 일치성이 필요할 때는 gpt-image-2를 사용하십시오. 공식 vs 역방향 비교도 보십시오.관련 문서
- GPT-Image-2-All 개요 - 같은 가격에 더 빠른 출력을 제공하는 자매 모델로, 크기를 고정할 필요가 없을 때 적합합니다
- ⚖️ 공식 vs 리버스 비교 - 공식
gpt-image-2대비 나란한 선택 가이드입니다(-all/-vip를 다룹니다) - 텍스트-투-이미지 플레이그라운드 -
/v1/images/generations호환 엔드포인트로,size을 전달하여 크기를 고정합니다 - 이미지 편집 플레이그라운드 -
/v1/images/edits다중 이미지 융합 및 편집 - GPT-Image-2 공식 -
quality매개변수 / 마스크 기반 재도색 / 엄격한 OpenAI API 필드 일치를 위해 사용합니다 - GPT-Image 시리즈 개요 - 공식 GPT-Image 비교
- API 매뉴얼 - 일반 호출 규칙
gpt-image-2를 사용하십시오.