개요
gpt-image-2-all은 APIYI 플랫폼에서 제공되는 GPT 이미지 생성 역공학 모델(ChatGPT 웹 계열)입니다. 호출당 $0.03/image라는 매우 경쟁력 있는 가격으로, 약 30–60초 만에 이미지를 생성하며 텍스트-이미지 / 단일 이미지 편집 / 다중 이미지 융합 / 자연어 편집을 지원합니다. 또한 텍스트 렌더링 정확도가 높고 중국어 prompt를 기본 지원합니다./v1/images/generations(텍스트-이미지)와 /v1/images/edits(이미지 편집)를 사용합니다.출력 크기나 4K를 고정해야 합니까? 자매 모델 gpt-image-2-vip로 전환하십시오. 호출 형식은 동일하며, size 필드 하나만 추가하면 됩니다.텍스트-이미지 API
/v1/images/generations — text prompt로 이미지를 생성합니다.이미지 편집 API
/v1/images/edits — 편집/융합 지침이 포함된 multipart 업로드입니다.핵심 기능
매우 경쟁력 있는 가격
뛰어난 텍스트 렌더링
중국어 prompt 친화적
다중 이미지 융합
더 빠른 출력
gpt-image-2-vip 및 공식 릴레이 gpt-image-2보다 더 빠릅니다R2 CDN 가속
response_format: "url"를 명시적으로 전달합니다자연어 편집
표준 엔드포인트 지원
/images/generations 및 /images/edits와 호환됩니다Pricing
- 정액 요금입니다. 해상도, 품질, prompt 길이에 따른 구간이 없습니다
- 실패한 요청은 과금되지 않습니다(인증 실패, 파라미터 검증 오류)
- N개의 이미지를 생성하려면 API를 N번 병렬로 호출하십시오
그룹 설정
gpt-image-2-all는 Default 그룹에 있습니다 — 추가 그룹이 필요 없습니다. 역방향 채널은 현재 안정적인 공급이 있어, 공식 릴레이 gpt-image-2처럼 엔터프라이즈 그룹 대체 이야기는 없습니다.
결정적 URL 출력이 필요하시면 → image2_OSS 그룹으로 전환하십시오
기본 그룹에서 2026년 7월에 측정한 결과, gpt-image-2-all(및 gpt-image-2-vip)는 response_format를 생략하면 b64_json를 반환합니다; 이미지 URL을 얻으려면 response_format: "url"를 명시적으로 전달하십시오. 기본 그룹의 출력 형식은 보장되지 않습니다 — 과거에는 url를 기본값으로 사용하고 부하가 높을 때 b64_json로 폴백했으며, 채널 버전마다 달라졌습니다.
비즈니스가 URL 출력에 의존한다면(URL을 데이터베이스에 바로 쓰거나, 프런트엔드에서 URL로 렌더링해야 하거나, base64는 허용되지 않는 경우), 토큰의 그룹을 **image2_OSS**로 전환하십시오. 이는 결정적 URL 출력을 위해 설계된 그룹으로, **1x 요율 배수(추가 요금 없음)**가 적용되며, 역방향 모델 gpt-image-2-all와 gpt-image-2-vip 모두에 유효합니다. 응답에는 항상 이미지 URL이 포함되며 base64로 폴백하지 않습니다.

Token creation: set billing mode to "pay-as-you-go first" and pick the image2_OSS group (1x) — use it when you need deterministic URL output
image2Enterprise 그룹에 대하여: /en/live/2026-04/image2-enterprise-stable
기술 사양
엔드포인트
size 파라미터로 출력 크기를 고정하고 싶으신가요? 자매 모델 gpt-image-2-vip을 사용하십시오 — 엔드포인트는 동일하고, size 필드 하나만 추가하면 됩니다(4K를 포함한 30개의 명시적 크기).크기 및 종횡비 제어(프롬프트에서 설명)
gpt-image-2-all에는 size 파라미터가 없습니다. 즉, 크기는 프롬프트에 설명합니다. 출력 크기를 엄격하게 고정해야 하는 경우(이커머스 히어로 이미지, 포스터 템플릿, 4K 배경화면 등)에는 대신 gpt-image-2-vip을 사용하십시오.
검증된 “프롬프트 표현 → 실제 해상도” 표
아래 8개의 표현은 실험적으로 안정적으로 재현됨이 검증되었습니다. 첫 번째 열의 표현을 프롬프트의 앞부분에 넣으면 두 번째 열에 표시된 해상도를 얻을 수 있습니다(모든 출력은 약 1.5K 픽셀 티어에 속합니다).- 모든 출력은 약 1.5K 픽셀 티어(긴 변이 1500~2000px)입니다. 이는 모델의 실효 상한이며, 진정한 의미의 “임의 해상도”는 아닙니다.
- 프롬프트에 표의 표현만 단독으로 포함될 때 재현성이 가장 높습니다. 다른 구성 관련 단어를 섞으면 결과가 흔들릴 수 있습니다.
- 중국어 문자열은 실제로 전송하는 값이므로, 번역하지 말고 그대로 유지하는 것을 권장합니다.
스타일 표현(고정 해상도 없음)
아래 표현에는 검증된 해상도가 없습니다. 위 표와 함께 스타일 수정어로만 사용하십시오.이 표를 최종 사용자에게 노출하기
gpt-image-2-all에는 size 파라미터가 없지만, 사용자에게 여전히 “크기 / 종횡비” 드롭다운을 제공할 수 있으며, 이는 마치 공식 size 필드처럼 느껴지게 만들 수 있습니다.
- 위 표의 프롬프트 표현을 옵션
value로 사용하십시오(예:横版 16:9) - 옵션 레이블에 예상 해상도를 표시하여(예:
Landscape 16:9 (1672×941)) 사용자가 어떤 결과를 얻게 될지 알 수 있게 하십시오 - 백엔드에서는 선택한 표현을 사용자의 원래 프롬프트 앞에 붙인 뒤 API로 전송하십시오
모범 사례
입력 이미지를 1.5MB 미만으로 압축합니다(이미지 편집 / 다중 이미지 융합)
4K / 8K을 프롬프트에 넣어도 고해상도 이미지는 만들어지지 않습니다. 더 큰 출력을 안정적으로 얻으려면 위의 “검증된 프롬프트 표현 → 실제 해상도” 표에 있는 검증된 표현을 사용합니다.크기를 프롬프트 앞에 배치합니다
텍스트 요소를 자신 있게 사용합니다
다중 이미지 순서를 표기합니다
image 필드를 반복하는 순서는 의미가 있습니다. 프롬프트에서 이를 “image1/image2/image3”로 명시적으로 참조합니다.필요에 따라 응답 형식을 선택합니다
b64_json을 사용하고; 서버 측 저장/전달에는 url를 사용합니다.300초 타임아웃을 사용합니다
거부되는 매개변수를 제거합니다
gpt-image-2-all는 size, n, quality, aspect_ratio를 거부합니다 — 이를 보내면 검증 오류가 발생할 수 있습니다. size를 통과하려면 gpt-image-2-vip로 전환합니다.오류 코드 및 재시도
- 요청 타임아웃은 300초부터 시작합니다(보수적 설정입니다. 일반적으로는 30–60초이지만, 이미지 업로드/다운로드와 리버스 채널 피크 꼬리 구간 때문에 편차가 큽니다 — 120초는 잘못된 타임아웃이 자주 발생합니다)
- 5xx와 타임아웃에는 지수 백오프를 사용합니다(2–3회 재시도 권장)
- 디버깅을 위해
request-id응답 헤더를 기록합니다
자주 묻는 질문
gpt-image-2-all과 gpt-image-2-vip를 모두 보이는데, 무엇을 선택해야 합니까?
gpt-image-2-all과 gpt-image-2-vip를 모두 보이는데, 무엇을 선택해야 합니까?
size 지원과 생성 시간입니다:- 엄격한 크기 제어는 필요 없고 더 빠른 출력을 원함 →
gpt-image-2-all(~30–60초, prompt에 크기를 설명하면 됩니다). - 고정된 출력 크기 또는 4K가 필요함 →
gpt-image-2-vip(~90–150초, 4K를 포함한 30가지 명시적 크기 지원). quality조절 노브나 완전한 OpenAI API 필드 호환성이 필요함 → 공식gpt-image-2를 사용하십시오.
한 번에 여러 이미지를 생성할 수 있습니까?
한 번에 여러 이미지를 생성할 수 있습니까?
n 파라미터를 지원합니까? n=3을 보내면 어떻게 됩니까?
n 파라미터를 지원합니까? n=3을 보내면 어떻게 됩니까?
n=3를 보내면 과금은 0.03 × 3 = $0.09가 되지만, 실제로는 이미지 1장만 반환됩니다. 낭비되는 과금을 막으려면 요청에서 n 필드를 제거하십시오.콘텐츠가 거부되거나 모델이 '그건 할 수 없습니다'라고 답하면 과금됩니까?
콘텐츠가 거부되거나 모델이 '그건 할 수 없습니다'라고 답하면 과금됩니까?
- ✅ 사전 필터링 및 사용자 경고: 프런트엔드나 게이트웨이에 키워드/시나리오 필터(실명, 저작권 캐릭터, 민감한 주제)를 추가하고 “유명인 / IP 주제는 업스트림 정책으로 실패할 수 있으며 과금될 수 있습니다.” 같은 UI 안내를 표시하십시오. 이렇게 하면 낭비되는 과금을 크게 줄일 수 있습니다.
- ✅ 소비자 제품은 월별 보전: 소비자 대상 제품은 사용자 입력을 완전히 차단하기 어렵다는 점을 이해합니다. 월 지출이 충분히 크다면($1000+/month), 로그를 월 단위로 일괄 처리(짧은 지연의 호출은 보통 soft refusal입니다)한 뒤 지원팀에 연락하여 1회성 수동 크레딧을 요청할 수 있습니다. 호출별 이의 제기는 필요하지 않습니다.
b64_json에 data:image/png;base64, 접두사를 추가해야 합니까?
b64_json에 data:image/png;base64, 접두사를 추가해야 합니까?
b64_json는 data: 접두사가 없는 순수 base64입니다. 파일로 쓰려면 디코드하거나, 렌더링하기 전에 직접 접두사를 붙이십시오. 이전 버전에는 접두사가 포함되어 있었습니다. 코드에 startsWith('data:') 검사를 추가하십시오: 접두사가 있으면 값을 그대로 img src로 사용하고, 없으면 먼저 디코드하거나 접두사를 붙이십시오. 이렇게 하면 중복 접두사 문제나 접두사가 붙은 문자열을 디코드해 깨진 이미지를 만드는 일을 피할 수 있습니다.prompt에 1024x1024라고 적었는데 왜 다른 크기가 나오나요?
prompt에 1024x1024라고 적었는데 왜 다른 크기가 나오나요?
cinematic, phone poster, square composition)와 함께 사용하십시오.특정 해상도에 안정적으로 대응하는 문구는 이 페이지 앞부분의 “검증된 prompt 문구 → 실제 해상도” 표를 참고하십시오(“Size and Aspect Ratio Control” 아래).입력 이미지를 압축해야 합니까? prompt에 4K / 8K를 적으면 도움이 됩니까?
입력 이미지를 압축해야 합니까? prompt에 4K / 8K를 적으면 도움이 됩니까?
4K / 8K를 prompt에 넣는다고 해서 실제로 고해상도 이미지가 생성되지는 않습니다 — 그런 단어들은 장식일 뿐이며, 모델은 그것들 때문에 해상도를 올리지 않습니다. 더 큰 출력을 안정적으로 얻으려면 위의 “검증된 prompt 문구 → 실제 해상도” 표에 있는 검증된 문구를 사용하십시오(예: cinematic, phone poster, square composition). 크기를 엄격히 고정하거나 4K가 필요하면 gpt-image-2-vip로 전환하십시오(4K 포함 30가지 명시적 크기, 이미지당 고정 $0.03).참조 이미지의 최대 크기와 지원 형식은 무엇입니까?
참조 이미지의 최대 크기와 지원 형식은 무엇입니까?
png / jpg / webp입니다. 지나치게 큰 이미지는 게이트웨이 제한에 걸릴 수 있습니다. 다중 이미지 융합의 각 이미지는 이 제한을 충족해야 합니다.반환된 이미지 URL은 얼마나 오래 유효합니까? 다운로드해야 합니까?
반환된 이미지 URL은 얼마나 오래 유효합니까? 다운로드해야 합니까?
url 필드는 url 모드 응답의 약 1일(24시간) 후 만료되는 R2 CDN 링크입니다. 그 이후의 요청은 404를 반환합니다.강력히 권장합니다: 생성 직후 생성된 이미지를 자체 오브젝트 스토리지(S3 / OSS / R2), CDN 또는 데이터베이스에 다운로드해 보관하십시오. 반환된 URL을 장기적으로 핫링크하지 마십시오.권장하는 두 가지 방법:- 서버 측 프록시: 응답 직후 곧바로
requests.get(url)하여 자체 스토리지에 저장하고, 프런트엔드에는 자체 URL을 반환합니다; b64_json사용: 요청에"response_format": "b64_json"를 추가해 base64 이미지 데이터를 직접 받습니다 — 교차 출처 다운로드가 하나 줄어들어 프런트엔드 렌더링이나 파일로 바로 쓰기에 적합합니다.
스트리밍을 지원합니까?
스트리밍을 지원합니까?
공식 OpenAI SDK를 사용할 수 있습니까?
공식 OpenAI SDK를 사용할 수 있습니까?
base_url를 https://api.apiyi.com/v1로 지정하고 api_key를 APIYI 토큰으로 설정하십시오. 다만 client.images.generate()는 기본적으로 size/n를 전송합니다. 이 모델은 두 파라미터를 모두 거부하므로, requests / fetch를 사용해 /v1/images/generations와 /v1/images/edits에 대해 raw HTTP 호출을 하는 것을 권장합니다.중국어와 영어 prompt는 의미 있는 차이가 있습니까?
중국어와 영어 prompt는 의미 있는 차이가 있습니까?
여전히 /v1/chat/completions로 이미지를 생성할 수 있습니까?
여전히 /v1/chat/completions로 이미지를 생성할 수 있습니까?
/v1/images/generations와 /v1/images/edits를 사용하십시오(더 안정적이며, 공식 릴레이 gpt-image-2에서도 같은 코드가 작동합니다).chat 기반 스타일은 두 가지 경우에만 의미가 있습니다. 다중 턴 반복 편집이 필요할 때, 또는 온라인 이미지 URL을 직접 전달할 때입니다. 이미지 의도가 모호하면 모델이 이미지 대신 일반 텍스트를 반환할 수 있습니다(이를 강화하려면 prompt 앞에 “Generate an image:” 같은 고정 접두사를 붙이십시오).전체 파라미터는 chat 기반 API 참고 문서를 참조하십시오.관련 문서
- ⚖️ 공식 vs 리버스 비교 - 공식
gpt-image-2와 나란히 비교하는 선택 가이드 - 텍스트-이미지 플레이그라운드 -
/v1/images/generations호환 엔드포인트 - 이미지 편집 플레이그라운드 -
/v1/images/edits다중 이미지 융합 및 편집 - GPT-Image-2-VIP (동일 가격,
size및 4K 지원) - 30개의 명시적 크기(4K 포함)를 지원하는 동일 가격의 자매 모델; 호출 형식은 동일합니다 - GPT-Image-2 공식(token 과금) -
quality파라미터 / 마스크 기반 재페인팅 / 엄격한 OpenAI-API 필드 일치를 위한 용도 - GPT-Image 시리즈 개요 - 공식 GPT-Image 비교
- 커뮤니티: Luck GPT-Image 2 ComfyUI 노드 - ComfyUI에서
gpt-image-2-all를 직접 호출합니다(이중 엔드포인트: chat_completions / images_api) - 커뮤니티: APIYI GPT-Image 2 스킬 - 한 문장으로 Codex CLI / Cursor / Gemini CLI 및 기타 AI 코딩 도구에서 호출합니다
- API 매뉴얼 - 일반 호출 규약