size 매개변수를 다시 사용할 수 있습니다 (업데이트 2026-07-22): size를 명시적으로 전달하면 이제 예상대로 출력 크기가 잠기며, 이 페이지의 30개 크기 참조 표도 다시 적용됩니다. 참고: size는 /v1/images/generations 및 /v1/images/edits 엔드포인트에서만 동작합니다 — /v1/chat/completions 채팅 엔드포인트는 size 매개변수를 지원하지 않으므로, 채팅 기반 이미지 생성에서는 크기를 잠글 수 없습니다. 최신 상태는 실시간 업데이트 섹션을 참조하십시오.개요
gpt-image-2.5-vip(gpt-image-2.5-sunburst-vip의 별칭), gpt-image-2.5-flare-vip 및 이전 세대 gpt-image-2-vip는 APIYI의 Adobe 계열(Firefly) GPT 이미지 생성 역설계 모델입니다. 저품질 업스케일링이 아닌 고품질 GPT-Image 2.5 역설계 라인입니다. gpt-image-2.5-all과 동일한 고정 $0.03/이미지이며 요청/응답 형식도 동일합니다. 유일하게 중요한 차이점은 vip가 size 필드를 지원한다는 점으로, 4K를 포함한 **일반적인 크기 30개(가로세로 비율 10개 × 해상도 등급 3개: 1K 빠른 처리 / 2K 권장 / 4K 디테일)**를 제공합니다.
gpt-image-2.5-vip을 사용합니다. model 필드를 gpt-image-2.5-vip로 바꾸고 size 필드를 추가하기만 하면 됩니다. 나머지 코드는 모두 gpt-image-2.5-all과 동일하게 유지됩니다.gpt-image-2.5-vip(gpt-image-2.5-sunburst-vip의 별칭), gpt-image-2.5-flare-vip 및 이전 세대 gpt-image-2-vip는 동일한 Adobe 역설계 라인을 공유하며, 가격($0.03/이미지, 호출당), 그룹(Default / image2_OSS / svip), 엔드포인트 및 호출 형식이 동일합니다. 전환하려면 model만 바꾸면 됩니다. flare-vip는 더 빠르고 부드러운 느낌을 제공하며, sunburst-vip는 더 높은 품질과 편집 정밀도를 제공하고 시각적으로 gpt-image-2-vip와 유사합니다. 매개변수 제한과 측정된 차이점은 아래의 “세 가지 -vip 모델 비교” 섹션에 나와 있습니다.텍스트-이미지 API
/v1/images/generations — 텍스트 prompt와 명시적인 출력 크기를 지정하는 size입니다.이미지 편집 API
/v1/images/edits — 편집/합성 지침과 함께 멀티파트 업로드를 사용합니다.AI 에이전트가 통합을 수행하도록 하기
.md 추가), 프로젝트에서 사용하는 자체 스택으로 코드를 작성합니다. timeout, base64 렌더링, 업로드 압축 및 30개의 유효한 size 값이 이미 요구 사항에 포함되어 있습니다.코딩 에이전트를 사용하여 gpt-image-2.5-vip 시리즈의 텍스트-이미지 및 이미지 편집을 통합하거나 문제를 해결하십시오. Codex, Claude Code, Cursor 및 유사한 도구에 복사하여 붙여 넣으십시오.
이 prompt가 방지하는 문제
이 prompt가 방지하는 문제
gpt-image-2-all 대비 주요 차이점
gpt-image-2-vip과 gpt-image-2-all은 모두 역공학 기반 채널이며, 가격과 호출 코드는 동일합니다. 서로 대칭적으로 동작합니다 — 동일한 요청에서 model 필드만 바꾸면 동작이 대체로 동일합니다. 차이점은 다음과 같습니다.
세 가지 -vip 모델 비교(측정일 2026-09-09)
동일한 채널과 token에서 모델 이름만 변경한 253회 요청의 3방향 비교와 26회의 직렬 경계 호출입니다. 계약은 셀 단위로 동일하며, 아래 행만 다릅니다.quality와 투명 배경은 과거에 gpt-image-2-vip에서 거부되었지만 이제 허용됩니다 — 채널 동작일 뿐 보장이 아니므로 실제 응답을 따르십시오.
핵심 기능
출력 크기 고정
size 필드는 30가지 일반 크기를 지원합니다 — 전자상거래 히어로 이미지, 포스터 템플릿, 4K 배경화면을 모두 정확한 픽셀로 출력합니다.4K 고해상도
모든 크기에 동일한 요금
-all과 동일한 호출 형식
gpt-image-2-all과 동일합니다 — model 문자열만으로 모델을 전환할 수 있습니다.고품질 텍스트 렌더링
중국어 Prompt 친화적
자연어 편집
표준 엔드포인트 지원
/images/generations 및 /images/edits와 호환됩니다가격
- 30개 모든 크기에 이미지당 $0.03의 정액 요금 적용 — 4K Detail에 대한 추가 요금 없음
- 실패한 요청에는 요금이 부과되지 않습니다(인증 실패, 파라미터 검증 오류)
- 이미지 N개가 필요한 경우 API를 N회 병렬로 호출합니다
그룹 설정
gpt-image-2-vip은 Default 그룹에 있습니다 — 추가 그룹이 필요하지 않습니다. 현재 역방향 채널은 안정적인 공급을 제공하므로, 공식 릴레이 gpt-image-2과 같은 엔터프라이즈 그룹 폴백 구성이 없습니다.
결정론적 URL 출력이 필요하신가요? → image2_OSS 그룹으로 전환하십시오
2026년 7월 기본 그룹에서 측정한 결과, gpt-image-2-vip(및 gpt-image-2-all)은 response_format이 생략되면 b64_json을 반환합니다. 이미지 URL을 받으려면 response_format: "url"을 명시적으로 전달하십시오. 기본 그룹의 출력 형식은 보장되지 않습니다 — 과거에는 기본적으로 url을 사용하고 부하가 발생하면 b64_json로 폴백했으며, 채널 버전에 따라 변경된 적이 있습니다.
비즈니스가 URL 출력에 의존하는 경우(URL을 데이터베이스에 바로 기록하거나, URL로 프런트엔드에서 렌더링하거나, base64를 허용할 수 없는 경우) 토큰의 그룹을 **image2_OSS**로 전환하십시오 — 이 그룹은 결정론적 URL 출력을 목적으로 설계되었으며 **1x 요율 배수(추가 요금 없음)**가 적용되고, 두 역방향 모델 gpt-image-2-vip 및 gpt-image-2-all 모두에서 사용할 수 있습니다. 응답에 항상 이미지 URL이 포함되며 base64로 폴백되지 않음을 보장합니다.

Token creation: set billing mode to "pay-as-you-go first" and pick the image2_OSS group (1x) — use it when you need deterministic URL output
image2Enterprise 그룹 정보: /en/live/2026-04/image2-enterprise-stable
기술 사양
엔드포인트
gpt-image-2-vip는 gpt-image-2-all와 완전히 동일한 두 엔드포인트와 호환됩니다. 필요하면 model 필드만 바꾸고 size를 추가하면 됩니다:
지원 크기 (전체 30개 크기 표)
gpt-image-2-vip은 가로세로 비율 10개 × 해상도 등급 3개 = 총 30개 크기를 지원합니다. 요청 본문에 size: "WIDTHxHEIGHT"(소문자 ASCII x)를 직접 전달합니다.
1K 빠른 처리 — 초안 및 저비용 반복 작업
2K 권장 — 기본 등급 (대부분의 프로덕션 출력)
4K 상세 — 대형 결과물
size만 전달하고, quality은 전달하지 마십시오):
모범 사례
입력 이미지를 1.5MB 미만으로 압축합니다(이미지 편집 / 다중 이미지 융합)
shell_api_error / Unknown error 응답은 대부분 지나치게 큰 입력으로 인해 발생하므로, 압축하면 성공률과 지연 시간이 눈에 띄게 개선됩니다. 출력 해상도는 입력 크기가 아니라 size 필드로 결정됩니다 — 입력을 축소하면 처리 속도만 빨라질 뿐 품질에는 영향을 주지 않습니다. 프롬프트에 4K / 8K을 반복해서 넣어도 4K 이미지가 생성되지는 않습니다. 해상도는 프롬프트의 불필요한 설명이 아니라 size로 설정됩니다.결과물에 따라 크기 등급을 선택합니다
크기에는 소문자 ASCII x를 사용합니다
"size": "1536x1024"를 전송합니다 — 1536×1024도 아니고 대문자 X도 아닙니다.quality는 high까지 지원하며 n은 전달하지 않습니다
auto / low / medium / high를 허용합니다(보장 사항은 아닙니다. 2.5 high은 gpt-image-2-vip medium과 같을 때만 해당함). xhigh / max은 거부됩니다. n은 호출마다 항상 이미지 1개를 반환하므로 여러 이미지가 필요하면 병렬로 호출합니다.타임아웃을 300초로 설정합니다
필요에 따라 응답 형식을 선택합니다
b64_json를 사용하고, 서버 측 저장/전달에는 url를 사용합니다.-all과 코드를 공유합니다
model를 gpt-image-2-all와 gpt-image-2-vip 사이에서 전환합니다. 크기를 고정해야 할 때는 vip를 사용하고, 가장 빠르게 반복 작업을 진행하려면 -all로 다시 전환합니다.오류 코드 및 재시도
- 요청 시간 초과를 300초부터 시작하도록 설정합니다(보수적 설정이며, 일반적으로 90~150초이지만 4K 상세 등급 및 피크 롱테일에서는 더 길어질 수 있음)
- 5xx 및 시간 초과에 지수 백오프를 사용합니다(2~3회 재시도 권장)
- 디버깅을 위해
request-id응답 헤더를 기록합니다
FAQ
vip와 -all 간에 코드를 공유할 수 있습니까?
vip와 -all 간에 코드를 공유할 수 있습니까?
/v1/images/generations, /v1/images/edits)는 요청 필드, 응답 필드 및 b64_json 접두사 동작을 공유합니다. 차이점은 다음과 같습니다.model필드:gpt-image-2-vip↔gpt-image-2-allsize필드: vip는 30개 크기 세트를 허용하지만, -all은size을 거부합니다(대신 크기를 prompt에 입력합니다).
if model == 'vip': payload['size'] = ... 스위치를 사용하여 하나의 코드베이스를 유지하는 것입니다.vip는 왜 훨씬 느립니까?
vip는 왜 훨씬 느립니까?
gpt-image-2-vip은 Adobe 역방향 채널(Firefly)을 사용하므로 일반적으로 90~150초가 걸립니다. 이는 공식 gpt-image-2(100gpt-image-2-all(30gpt-image-2-all을 우선 사용하고, 고정된 크기 또는 4K가 필요한 경우에만 vip로 전환하십시오.크기는 반드시 표에 있는 값이어야 합니까? 1024x768을 보내면 어떻게 됩니까?
크기는 반드시 표에 있는 값이어야 합니까? 1024x768을 보내면 어떻게 됩니까?
1024x1024 / 1600x1600), 그 외의 값은 16 단위로 정렬되며(1920x1080 → 1920×1088), 너무 작은 값은 최소 변의 크기까지 올림 처리됩니다(512x512 → 816×816). 요청한 크기와 다른 이미지가 반환될 수 있으므로, 정확한 크기가 중요할 때는 30개 프리셋을 사용하십시오.4K에서 500 오류가 자주 반환되는 이유는 무엇입니까? 안정적으로 4K를 얻으려면 어떻게 해야 합니까?
4K에서 500 오류가 자주 반환되는 이유는 무엇입니까? 안정적으로 4K를 얻으려면 어떻게 해야 합니까?
3840x2160 / 2880x2880)에서는 status_code: 500 오류가 더 쉽게 발생하며, 업스트림에서 다음을 반환합니다(invalid_request_error):- 2K Recommended를 우선 사용하십시오(예:
2048x1360/2048x2048). 성공률이 크게 높고 이미지당 $0.03으로 동일합니다. - img2img / 다중 이미지 융합에서는 입력 이미지 수를 줄이십시오. 역방향 채널은 입력 부하가 높을 때 처리가 어려워져 4K 실패율이 더욱 높아집니다. 각 입력 이미지를 1.5MB 미만으로 사전 압축하는 것도 도움이 됩니다.
- 보장된 4K가 필요한 경우 공식 프록시
gpt-image-2+image2Enterprise그룹으로 전환하십시오. 공식 프록시의 4K는 더 비싸지만(이미지당 ~$0.3+), 훨씬 안정적이므로 4K 제공이 필수인 경우에 적합합니다.
입력 이미지를 압축해야 합니까? prompt에 4K / 8K를 입력하면 도움이 됩니까?
입력 이미지를 압축해야 합니까? prompt에 4K / 8K를 입력하면 도움이 됩니까?
shell_api_error / Unknown error 응답은 대부분 지나치게 큰 입력으로 인해 발생하며, 압축하면 성공률과 지연 시간이 눈에 띄게 개선됩니다. 참고로 1.5MB는 안정성과 속도를 위한 권장 상한이며, 위 FAQ의 10MB는 게이트웨이의 하드 제한입니다.압축으로 품질이 저하될까 걱정하지 않아도 됩니다. 출력 해상도는 입력 크기가 아니라 size 매개변수에 의해 결정됩니다. 입력 크기를 줄이면 처리 속도만 빨라집니다.prompt에 4K / 8K를 입력해도 실제로 4K 출력이 생성되지는 않습니다. prompt에 8K ultra HD라고 입력했지만 size을 1024x1024로 설정하면 여전히 1K 품질의 이미지를 받습니다. 4K를 사용하려면 size 필드에서 설정하십시오. 1K / 2K / 4K는 30개 크기 세트 전체에서 모두 이미지당 고정 $0.03으로 동일합니다.📖 출처: /en/live/2026-05/gpt-image-2-vip-unknown-error4K에 정말 추가 요금이 없습니까?
4K에 정말 추가 요금이 없습니까?
3840x2160 / 2880x2880 등)은 1K 및 2K와 동일하게 이미지당 $0.03입니다.n을 지원합니까? n=3을 전달하면 어떻게 됩니까?
n을 지원합니까? n=3을 전달하면 어떻게 됩니까?
n=3을 전달하면 과금은 0.03 × 3 = $0.09가 되지만, 실제로 반환되는 이미지는 1개뿐입니다. 불필요한 요금을 피하려면 n 필드를 제거하십시오.콘텐츠가 거부되거나 모델이 ‘요청을 처리할 수 없습니다’라고 답하면 과금됩니까?
콘텐츠가 거부되거나 모델이 ‘요청을 처리할 수 없습니다’라고 답하면 과금됩니까?
- ✅ 사전 필터링 및 사용자 경고: 프런트엔드 또는 게이트웨이에 키워드/시나리오 필터를 추가하십시오(실존 인물 이름, 저작권이 있는 캐릭터, 민감한 주제). 또한 “유명인 / IP 관련 주제는 실패할 수 있으며 업스트림 정책에 따라 과금될 수 있습니다.”와 같은 UI 안내를 표시하십시오. 이를 통해 불필요한 요금을 크게 줄일 수 있습니다.
- ✅ 소비자용 제품의 월별 환급: 소비자 대상 제품에서는 사용자 입력을 완전히 제한하기 어렵다는 점을 이해합니다. 월간 지출이 충분히 큰 경우(월 $1000 이상), 로그를 매월 일괄 정리하여(지연 시간이 짧은 호출은 대개 소프트 거부입니다) 지원팀에 일회성 수동 크레딧을 문의할 수 있습니다. 호출별 이의 제기를 제출할 필요는 없습니다.
b64_json에 data:image/png;base64, 접두사를 추가해야 합니까?
b64_json에 data:image/png;base64, 접두사를 추가해야 합니까?
b64_json은 data: 접두사가 없는 원시 base64입니다. 이를 디코딩하여 파일로 저장하거나, 렌더링하기 전에 직접 접두사를 추가하십시오. 단, 이전 버전에는 접두사가 포함되어 있었습니다. 코드에 startsWith('data:') 검사를 추가하십시오. 접두사가 있으면 값을 그대로 img src로 사용하고, 없으면 먼저 디코딩하거나 접두사를 추가하십시오. 이렇게 하면 접두사가 중복으로 추가되거나 접두사가 포함된 문자열을 디코딩하여 이미지가 손상되는 문제를 방지할 수 있습니다.참조 이미지의 최대 크기와 지원 형식은 무엇입니까?
참조 이미지의 최대 크기와 지원 형식은 무엇입니까?
png / jpg / webp입니다. 지나치게 큰 이미지는 게이트웨이 제한에 걸릴 수 있습니다. 다중 이미지 융합에서 각 이미지는 이 제한을 충족해야 합니다.반환된 이미지 URL은 얼마나 오래 유효합니까? 다운로드해야 합니까?
반환된 이미지 URL은 얼마나 오래 유효합니까? 다운로드해야 합니까?
url-mode 응답의 url 필드는 약 1일(24시간) 후 만료되는 R2 CDN 링크이므로, 그 이후의 요청은 404를 반환합니다.강력히 권장합니다: 생성 직후 생성된 이미지를 자체 오브젝트 스토리지(S3 / OSS / R2), CDN 또는 데이터베이스에 다운로드하여 보관하십시오.스트리밍을 지원합니까?
스트리밍을 지원합니까?
공식 OpenAI SDK를 사용할 수 있습니까?
공식 OpenAI SDK를 사용할 수 있습니까?
base_url을 https://api.apiyi.com/v1로 지정하고 api_key을 APIYI token으로 설정하십시오. client.images.generate(model="gpt-image-2.5-vip", size="2048x1360", prompt=...)은 직접 작동합니다.여전히 /v1/chat/completions를 통해 이미지를 생성할 수 있습니까?
여전히 /v1/chat/completions를 통해 이미지를 생성할 수 있습니까?
/v1/images/generations 및 /v1/images/edits을 사용하십시오. 더 안정적이며 동일한 코드가 공식 릴레이 gpt-image-2에서도 작동합니다.채팅 기반 방식은 다중 턴 반복 편집 또는 온라인 이미지 URL을 직접 전달하는 두 가지 경우에만 적합합니다. 이미지 의도가 모호하면 모델이 이미지 대신 일반 텍스트를 반환할 수 있습니다. 이를 방지하려면 prompt에 “이미지 생성:”과 같은 고정 접두사를 추가하여 이미지 생성 의도를 명확히 하십시오.전체 매개변수는 채팅 기반 API 레퍼런스를 참조하십시오.공식 gpt-image-2로 전환해야 하는 시점은 언제입니까?
공식 gpt-image-2로 전환해야 하는 시점은 언제입니까?
xhigh / max 품질 등급, 정밀한 마스크 인페인팅 또는 OpenAI-API 필드와의 엄격한 호환성이 필요하면 공식 gpt-image-2.5-flare / sunburst / gpt-image-2을 사용하십시오. 공식 버전과 역방향 버전 비교를 참조하십시오.관련 문서
- GPT-Image-2-All 개요 - 동일한 가격에 더 빠른 출력을 제공하는 자매 모델로, 크기를 고정할 필요가 없을 때 적합합니다
- ⚖️ 공식 버전과 역공학 버전 비교 - 공식
gpt-image-2과 나란히 비교하는 선택 가이드입니다(-all/-vip포함) - 텍스트-이미지 플레이그라운드 -
/v1/images/generations호환 엔드포인트이며,size을 전달하여 치수를 고정합니다 - 이미지 편집 플레이그라운드 -
/v1/images/edits다중 이미지 융합 및 편집을 지원합니다 - GPT-Image-2.5 / 2 공식 버전 -
xhigh/max등급, 정밀한 마스크 인페인팅, 엄격한 OpenAI-API 필드 호환성이 필요한 경우에 사용합니다 - 심층 분석: GPT-image-2.5 출시 - 2.5 듀얼 모델 출시를 다룹니다
- GPT-Image 시리즈 개요 - 공식 GPT-Image 비교입니다
- API 매뉴얼 - 일반적인 호출 규칙을 설명합니다
gpt-image-2을 사용하십시오.