개요
독립형 텍스트-투-이미지 / 이미지 편집 엔드포인트 외에도, APIYI는 OpenAI Responses API의 기본image_generation 도구도 지원합니다: 주 모델 gpt-5.5이 언제 그릴지 스스로 판단하고, 내부적으로 GPT Image 모델을 선택한 뒤, 이미지를 응답 output 배열에 base64로 반환합니다.
검증 완료(2026-06-17):
gpt-5.5 + POST /v1/responses + tools: [{"type": "image_generation"}]가 유효한 base64 PNG를 반환합니다. 두 이미지 경로는 모두 OpenAI의 공식 업스트림으로 직접 라우팅됩니다.어떤 것을 사용해야 합니까? “그냥 이미지가 필요할 뿐”인 경우가 대부분이라면, 독립형
/v1/images/generations 엔드포인트를 선호하십시오 — 실제 사용량 기준으로만 과금되므로 더 저렴하고 제어하기 쉽습니다. 이 페이지의 기본 도구 방식을 사용하는 것은 파이프라인이 반드시 Responses를 거쳐야 할 때만 하십시오(예: 에이전트 대화 안에서 gpt-5.5이 그릴지 여부를 자율적으로 결정하게 하는 경우). 이미지당 대략 $0.20의 고정 도구 호출 수수료가 추가됩니다.두 방식의 비교
핵심 차이: 네이티브 도구 방식은 이미지당 고정 ≈$0.20 도구 수수료가 추가되며, images API는 실제 사용량에 따라만 과금됩니다 — 따라서 대부분의 경우 더 저렴합니다.
최소 요청
cURL
파이썬 (requests)
응답 구조(핵심 필드)
성공 시(HTTP 200), 응답 본문에는 다음이 포함됩니다:- ✅ 성공:
output에type="image_generation_call"가 포함되어 있고,result가\x89PNG로 시작하는 유효한 이미지로 디코딩됩니다. - ⚠️ 조용히 제거됨: HTTP 200이지만
output에image_generation_call가 없고, 텍스트만 반환됩니다(채널이 이 도구를 지원하지 않을 때 흔합니다). - ❌ 오류: 200이 아니거나
unknown tool/no available channels등을 반환합니다. 후자의 두 경우에는/v1/images/generations으로 대체하십시오.
💰 과금
하나의 실제 호출을 예시로 들면(입력 2347 token, 출력 74 token, 1122×1402 PNG 1개 생성), 최종 과금 = $0.213954이며, 이는 정확합니다. 세부 내역:환산:500,000 quota = \$1(106977 quota = \$0.213954에서 도출됨).
비용 참고 사항
- 생성 비용은 이미지당 고정(≈$0.20/image)이며 prompt 길이에 따라 달라지지 않습니다. 텍스트 token 비용은 이에 비해 작습니다.
- 각 이미지는 약 60-90초가 걸립니다. 클라이언트 timeout은 ≥300s로 설정하십시오.
- 이미지만 필요하고 모델이 자율적으로 판단할 필요가 없다면, 독립형
/v1/images/generations엔드포인트가 더 저렴하고 더 제어하기 쉽습니다.
문제 해결
관련 문서
- GPT-Image-2 개요 - 모델 개요 및 과금
- 텍스트-이미지 API 레퍼런스 -
/v1/images/generations, 대부분의 경우 기본 선택지 - 이미지 편집 API 레퍼런스 -
/v1/images/edits, 참조 이미지 편집 / 다중 이미지 융합 / 마스크