Skip to main content
POST
Text-to-Image: generate image from text prompt
오른쪽의 인터랙티브 플레이그라운드는 실시간 테스트를 지원합니다. Authorization에 API 키를 입력하고(형식: Bearer sk-xxx), prompt를 입력한 다음 크기 / 품질을 선택하고 전송합니다.
사용 사례: 이 페이지는 “텍스트-투-이미지”용입니다. prompt만 입력하면 되며 이미지 업로드는 필요하지 않습니다. 참조 이미지 편집, 다중 이미지 융합 또는 마스크 인페인팅에는 이미지 편집 엔드포인트를 사용하십시오.
🖥️ 브라우저 Playground 제한(중요)이 엔드포인트는 응답으로 원시 base64 문자열(보통 수 MB)을 반환합니다. 브라우저 렌더링 제한으로 인해 오른쪽 Playground에 응답이 도착한 후 请求时发生错误: unable to complete request가 표시될 수 있습니다 — 요청은 실제로 성공했습니다; 브라우저가 그렇게 긴 base64 문자열을 렌더링하지 못할 뿐입니다.권장 워크플로(초보자 친화적):
  • 아래의 Python / Node.js / cURL 샘플을 복사하여 로컬에서 실행하십시오. 코드는 응답을 자동으로 base64.b64decodes하고 이미지를 파일로 저장합니다.
  • 인브라우저 Playground를 반드시 사용해야 한다면 size를 가장 낮은 등급(예: 1024x1024)으로 설정하고 응답을 줄이기 위해 qualitylow로 설정하십시오.
모든 이미지 API는 동기식입니다 — 폴링할 작업 ID가 없으며, 클라이언트가 연결을 끊으면 요청이 아직 과금 중이더라도 결과는 사라집니다. 이 모델에는 넉넉한 타임아웃을 설정하십시오. Image API 핵심 사항 및 모범 사례를 참조하십시오.
⚠️ 지원되지 않는 매개변수
  • input_fidelitygpt-image-2는 고품질을 강제합니다. 이를 전달하면 400이 반환됩니다. 1.5에서 마이그레이션하는 경우 해당 줄만 제거하십시오.
2560×1440를 초과하는 출력은 여전히 실험적입니다. 프로덕션에서는 프리셋인 2048x1152 / 2048x2048 / 3840x2160를 사용하는 것이 좋습니다.

코드 예제

Python (OpenAI SDK)

Python (원시 요청)

cURL

Node.js (네이티브 fetch)

브라우저 JavaScript (직접 렌더링)

매개변수 참조

레거시 DALL·E 값 standard / hdquality에 전달하지 마십시오. 공식 enum 값 네 가지 low / medium / high / auto만 허용됩니다. 레거시 값은 백엔드 채널마다 동작이 일관되지 않습니다. 어떤 경우에는 400(invalid_value)으로 즉시 실패하고, 어떤 경우에는 조용히 무시되어 요청이 auto로 실행됩니다(비용 예측 불가). 항상 네 가지 공식 값 중 하나를 명시적으로 전달하십시오.
자세한 제약 사항, 허용 값, 예시는 오른쪽 플레이그라운드에서 확인할 수 있습니다 — 모든 enum 필드는 드롭다운 선택을 지원합니다.

응답 형식

⚠️ b64_json은 원시 base64입니다, data:image/...;base64, 접두사 없이입니다. 클라이언트는 다음을 수행해야 합니다:
  • 파일 쓰기: base64.b64decode(b64_str) → 디스크에 기록
  • 브라우저 렌더링: data:image/png;base64,을 수동으로 앞에 붙입니다
2026년 7월 기준, gpt-image-2-all / gpt-image-2-vip도 원시 base64를 반환하지만, 이전 버전에는 접두사가 포함되어 있었습니다 — 모델 간에 코드를 공유할 때는 항상 먼저 startsWith('data:')를 확인하십시오.
usage 필드는 이 호출에 대해 실제로 과금된 token 수를 나타냅니다. input_tokens_details / output_tokens_details은 텍스트 token과 이미지 token을 별도로 분리합니다(image_tokens은 일반 text-to-image의 경우 항상 0입니다). 전체 필드 참고와 셀프서비스 비용 계산 공식은 개요 페이지의 각 호출의 실제 token 수를 확인하는 방법을 참조하십시오.

인증

Authorization
string
header
필수

API Key obtained from APIYI Console

본문

application/json
model
enum<string>
기본값:gpt-image-2
필수

Model name, fixed as gpt-image-2

사용 가능한 옵션:
gpt-image-2
prompt
string
필수

Prompt text. Supports both Chinese and English. Place scene description at the front for better adherence.

예시:

"Cyberpunk city at night, neon sign closeup, cinematic frame"

size
string
기본값:auto

Output size. Presets: 1024x1024 / 1536x1024 / 1024x1536 / 2048x2048 / 2048x1152 / 3840x2160 / 2160x3840. Also accepts any valid custom size (max edge ≤ 3840, both multiples of 16, ratio ≤ 3:1, total pixels 0.65–8.3MP).

예시:

"2048x1152"

quality
enum<string>
기본값:auto

Quality tier. low (sketches/batch), medium (daily), high (final/fine text), auto (default)

사용 가능한 옵션:
auto,
low,
medium,
high
output_format
enum<string>
기본값:png

Output format

사용 가능한 옵션:
png,
jpeg,
webp
output_compression
integer

Output compression (0–100), only effective for jpeg/webp

필수 범위: 0 <= x <= 100
예시:

85

background
enum<string>
기본값:auto

Background mode. auto (default) or opaque. Not supported: transparent

사용 가능한 옵션:
auto,
opaque
moderation
enum<string>
기본값:auto

Moderation strength. auto (default) or low

사용 가능한 옵션:
auto,
low
n
enum<integer>
기본값:1

Number of images. This model only supports 1

사용 가능한 옵션:
1

응답

Image generated successfully

created
integer

Unix timestamp

예시:

1776832476

data
object[]

Generation results (this model returns 1 image per call)

usage
object

Token usage for this call (used for token-based billing)