Skip to main content
POST
Image editing: edit or fuse reference images with instructions
오른쪽의 대화형 Playground는 로컬 파일을 직접 업로드할 수 있습니다. API 키를 Authorization 필드에 입력하고(형식: Bearer sk-xxx), 이미지를 선택한 뒤 promptmodel를 채우고 전송을 클릭합니다.
범위: 이 페이지는 하나 이상의 참고 이미지를 편집하거나 합성하는 데 사용됩니다. 요청에는 multipart/form-data를 사용합니다. 순수한 텍스트-이미지 생성을 하려면 Text-to-Image 엔드포인트를 사용합니다.
🖥️ 브라우저 Playground 제한(기본 b64_json 모드)이 엔드포인트는 **기본값이 response_format: "b64_json"**이므로, 응답에 수 MB 크기의 base64 문자열이 포함되고 브라우저 Playground에 请求时发生错误: unable to complete request가 표시될 수 있습니다. — 실제로 요청은 성공했습니다; 브라우저가 그렇게 긴 base64 문자열을 렌더링할 수 없을 뿐입니다.권장 워크플로:
  • Playground에서 이미지만 보고 싶으신가요? "response_format": "url"를 명시적으로 전달하세요 — 응답이 단일 R2 링크가 되어 정상적으로 렌더링됩니다.
  • base64가 필요하거나 큰 참고 이미지를 업로드하려면? 아래 코드 샘플을 복사해 로컬에서 실행하세요 — 코드가 업로드와 디코딩을 자동으로 처리합니다.
📎 다중 이미지의 순서는 중요합니다image 필드는 반복해서 사용하여 여러 참고 이미지를 업로드할 수 있습니다. 순서에 따라 프롬프트에서 “image1/image2/image3”가 어떻게 해석되는지가 결정됩니다. 다음처럼 명시적으로 지칭하는 것을 권장합니다.
image1의 인물을 image2의 장면에 넣고, image3의 예술 스타일을 사용합니다
권장 사항: 이미지당 10MB 이하, 형식 png / jpg / webp. 너무 큰 이미지는 게이트웨이 제한에 걸릴 수 있습니다.
🎯 형태 보존 편집: 이 엔드포인트의 출력 종횡비는 프롬프트가 편집 대상으로 지정한 참고 이미지에 맞춰집니다 — 다중 이미지 상황에서 반드시 첫 번째 이미지는 아닙니다.예를 들어, 프롬프트가 “image2를 수정, image2의 옷과 모자를 image1에 맞게 바꾸세요”인 경우, image2가 1:1이면 출력도 1:1입니다(image1이 가로형 16:9이더라도).의상 교체, 액세서리 추가, 리터칭 및 기타 형태 보존 편집에 유용합니다. size 필드는 이 모델에 영향을 주지 않습니다(아무 값을 보내도 조용히 무시됩니다. 엄격한 크기 고정이 필요하면 gpt-image-2-vip를 사용합니다). 프롬프트가 대상을 지정하지 않으면 모델이 자체적으로 결정합니다.

코드 예시

Python

단일 이미지 편집:
다중 이미지 융합:

cURL

단일 이미지 편집:
다중 이미지 융합:

Node.js (native fetch + FormData)

브라우저 JavaScript (File 객체)

매개변수 빠른 참고

Multi-turn iteration: 이전 출력 이미지를 새 지시와 함께 image 입력으로 다시 넣어 결과를 반복적으로 다듬습니다.

응답 형식

텍스트-투-이미지 엔드포인트와 동일합니다: data[0]url 또는 b64_json만 반환하며 — 둘 다는 반환하지 않습니다(response_format에 따라 다릅니다). 이 엔드포인트는 기본값이 b64_json입니다. b64_json 모드(기본값):
url 모드(명시적인 "response_format": "url" 필요):
2026년 7월 검증됨: b64_json 필드는 data: 접두사 없는 원시 base64입니다 — 렌더링하기 전에 디코딩하거나 직접 접두사를 붙이십시오. 이전 버전에는 접두사가 포함되어 있었습니다, 따라서 두 형태를 모두 처리하려면 항상 먼저 startsWith('data:')를 확인하십시오.

인증

Authorization
string
header
필수

API Key from the API易 Console

본문

multipart/form-data
model
enum<string>
기본값:gpt-image-2-all
필수

Model name, fixed to gpt-image-2-all

사용 가능한 옵션:
gpt-image-2-all
prompt
string
필수

Edit/fusion instruction. For multi-image fusion, reference upload order as image1/image2/image3

예시:

"Put the person from image1 into the scene of image2, using the art style of image3"

image
file[]
필수

Reference images. For a single image, send the field once; for multiple images, repeat the same image field (e.g., -F [email protected] -F [email protected]) — upload order maps to image1 / image2 / ... in the prompt. Recommended ≤ 10MB each, formats png / jpg / webp.

response_format
enum<string>
기본값:b64_json

Response format. b64_json returns a base64 string already prefixed with a data URL header (default); url returns an R2 CDN link

사용 가능한 옵션:
b64_json,
url

응답

Image successfully generated. Defaults to base64 in data[0].b64_jsonurl is not returned in the same response.

Image editing response. data[0] returns either url or b64_json, never both (depends on response_format; this endpoint defaults to b64_json).

data
object[]

Result array (this model returns 1 image per call)

created
integer

Unix timestamp (seconds)

usage
object

Token usage statistics