Skip to main content
POST
Text-to-Image: generate image from text prompt
오른쪽의 대화형 플레이그라운드는 실시간 테스트를 지원합니다. Authorization에 API 키를 입력하고(형식: Bearer sk-xxx), prompt를 입력한 다음 크기 / 품질을 선택하고 전송합니다.
사용 사례: 이 페이지는 “텍스트-투-이미지”용입니다. prompt만 입력하면 되며, 이미지 업로드는 필요하지 않습니다. 참조 이미지 편집, 다중 이미지 융합 또는 마스크 인페인팅은 Image Edit 엔드포인트를 사용하십시오.
🖥️ 브라우저 플레이그라운드 제한(중요)이 엔드포인트는 응답에서 원시 base64 문자열(보통 수 MB)을 반환합니다. 브라우저 렌더링 제한 때문에, 오른쪽 플레이그라운드는 응답이 도착한 뒤 请求时发生错误: unable to complete request를 표시할 수 있습니다 — 실제로 요청은 성공했습니다; 브라우저가 그렇게 긴 base64 문자열을 렌더링하지 못할 뿐입니다.권장 워크플로(초보자 친화적):
  • 아래 Python / Node.js / cURL 예제를 복사하여 로컬에서 실행하십시오. 코드는 응답을 자동으로 base64.b64decodes하고 이미지를 파일로 저장합니다.
  • 브라우저 내 플레이그라운드를 반드시 사용해야 한다면, size을/를 가장 작은 티어로(예: 1024x1024) 설정하고 quality을/를 low로 설정하여 응답을 줄이십시오.
모든 이미지 API는 동기식입니다 — 폴링할 task ID가 없고, 클라이언트가 끊기면 요청이 아직 과금되는 동안 결과는 사라집니다. 이 모델에는 넉넉한 timeout을 설정하십시오; Image API Essentials & Best Practices를 참조하십시오.
⚠️ 지원하지 않는 매개변수
  • input_fidelitygpt-image-2는 고충실도를 강제합니다. 이를 전달하면 400이 반환됩니다. 1.5에서 마이그레이션할 때는 해당 줄만 제거하면 됩니다.
  • background: "transparent" — 투명 배경은 지원되지 않습니다. 투명 처리가 필요하면 opaque를 사용하거나 후처리하십시오.
2560×1440를 초과하는 출력은 계속 실험적입니다. 프로덕션에서는 2048x1152 / 2048x2048 / 3840x2160 프리셋을 권장합니다.

코드 예제

Python (OpenAI SDK)

Python (원시 요청)

cURL

Node.js (네이티브 fetch)

브라우저 JavaScript (직접 렌더링)

매개변수 참조

레거시 DALL·E 값 standard / hdquality에 전달하지 마십시오.** 공식 enum 값 네 가지 low / medium / high / auto만 허용됩니다. 레거시 값은 백엔드 채널마다 일관되지 않게 동작합니다. 때로는 400(invalid_value)으로 즉시 실패하고, 때로는 조용히 무시되어 요청이 auto으로 실행됩니다(비용 예측 불가). 항상 네 가지 공식 값 중 하나를 명시적으로 전달하십시오.
자세한 제약, 허용 값, 예시는 오른쪽의 Playground에서 확인할 수 있습니다 — 모든 enum 필드는 드롭다운 선택을 지원합니다.

응답 형식

⚠️ b64_json은 원시 base64입니다, data:image/...;base64, 접두사 없이입니다. 클라이언트는 다음을 수행해야 합니다:
  • 파일 쓰기: base64.b64decode(b64_str) → 디스크에 기록
  • 브라우저 렌더링: data:image/png;base64,을 수동으로 앞에 붙입니다
2026년 7월 기준, gpt-image-2-all / gpt-image-2-vip도 원시 base64를 반환하지만, 이전 버전에는 접두사가 포함되어 있었습니다 — 모델 간에 코드를 공유할 때는 항상 먼저 startsWith('data:')를 확인하십시오.
usage 필드는 이 호출에 대해 실제로 과금된 token 수를 나타냅니다. input_tokens_details / output_tokens_details은 텍스트 token과 이미지 token을 별도로 분리합니다(image_tokens은 일반 text-to-image의 경우 항상 0입니다). 전체 필드 참고와 셀프서비스 비용 계산 공식은 개요 페이지의 각 호출의 실제 token 수를 확인하는 방법을 참조하십시오.

인증

Authorization
string
header
필수

API Key obtained from APIYI Console

본문

application/json
model
enum<string>
기본값:gpt-image-2
필수

Model name, fixed as gpt-image-2

사용 가능한 옵션:
gpt-image-2
prompt
string
필수

Prompt text. Supports both Chinese and English. Place scene description at the front for better adherence.

예시:

"Cyberpunk city at night, neon sign closeup, cinematic frame"

size
string
기본값:auto

Output size. Presets: 1024x1024 / 1536x1024 / 1024x1536 / 2048x2048 / 2048x1152 / 3840x2160 / 2160x3840. Also accepts any valid custom size (max edge ≤ 3840, both multiples of 16, ratio ≤ 3:1, total pixels 0.65–8.3MP).

예시:

"2048x1152"

quality
enum<string>
기본값:auto

Quality tier. low (sketches/batch), medium (daily), high (final/fine text), auto (default)

사용 가능한 옵션:
auto,
low,
medium,
high
output_format
enum<string>
기본값:png

Output format

사용 가능한 옵션:
png,
jpeg,
webp
output_compression
integer

Output compression (0–100), only effective for jpeg/webp

필수 범위: 0 <= x <= 100
예시:

85

background
enum<string>
기본값:auto

Background mode. auto (default) or opaque. Not supported: transparent

사용 가능한 옵션:
auto,
opaque
moderation
enum<string>
기본값:auto

Moderation strength. auto (default) or low

사용 가능한 옵션:
auto,
low
n
enum<integer>
기본값:1

Number of images. This model only supports 1

사용 가능한 옵션:
1

응답

Image generated successfully

created
integer

Unix timestamp

예시:

1776832476

data
object[]

Generation results (this model returns 1 image per call)

usage
object

Token usage for this call (used for token-based billing)