Skip to main content

개요

독립형 텍스트-투-이미지 / 이미지 편집 엔드포인트 외에도, APIYI는 OpenAI Responses API의 기본 image_generation 도구도 지원합니다: 주 모델 gpt-5.5이 언제 그릴지 스스로 판단하고, 내부적으로 GPT Image 모델을 선택한 뒤, 이미지를 응답 output 배열에 base64로 반환합니다.
검증 완료(2026-06-17): gpt-5.5 + POST /v1/responses + tools: [{"type": "image_generation"}]가 유효한 base64 PNG를 반환합니다. 두 이미지 경로는 모두 OpenAI의 공식 업스트림으로 직접 라우팅됩니다.
어떤 것을 사용해야 합니까? “그냥 이미지가 필요할 뿐”인 경우가 대부분이라면, 독립형 /v1/images/generations 엔드포인트를 선호하십시오 — 실제 사용량 기준으로만 과금되므로 더 저렴하고 제어하기 쉽습니다. 이 페이지의 기본 도구 방식을 사용하는 것은 파이프라인이 반드시 Responses를 거쳐야 할 때만 하십시오(예: 에이전트 대화 안에서 gpt-5.5이 그릴지 여부를 자율적으로 결정하게 하는 경우). 이미지당 대략 $0.20의 고정 도구 호출 수수료가 추가됩니다.

두 방식의 비교

핵심 차이: 네이티브 도구 방식은 이미지당 고정 ≈$0.20 도구 수수료가 추가되며, images API는 실제 사용량에 따라만 과금됩니다 — 따라서 대부분의 경우 더 저렴합니다.

최소 요청

cURL

파이썬 (requests)

선택적 매개변수는 tools 항목에 넣습니다: {"type": "image_generation", "output_format": "png|jpeg|webp", "size": "1024x1024", ...}. 생략하면 기본값(png)을 사용합니다.

응답 구조(핵심 필드)

성공 시(HTTP 200), 응답 본문에는 다음이 포함됩니다:
이미지가 실제로 생성되었는지 확인하는 방법:
  • 성공: outputtype="image_generation_call"가 포함되어 있고, result\x89PNG로 시작하는 유효한 이미지로 디코딩됩니다.
  • ⚠️ 조용히 제거됨: HTTP 200이지만 outputimage_generation_call가 없고, 텍스트만 반환됩니다(채널이 이 도구를 지원하지 않을 때 흔합니다).
  • 오류: 200이 아니거나 unknown tool / no available channels 등을 반환합니다. 후자의 두 경우에는 /v1/images/generations으로 대체하십시오.

💰 과금

하나의 실제 호출을 예시로 들면(입력 2347 token, 출력 74 token, 1122×1402 PNG 1개 생성), 최종 과금 = $0.213954이며, 이는 정확합니다. 세부 내역:
환산: 500,000 quota = \$1 (106977 quota = \$0.213954에서 도출됨).
콘솔 상세 페이지의 표시상 특이점입니다(고객에게 사전에 설명하십시오)APIYI의 “조건부 과금 상세” 페이지에서는:
  • 상단 섹션에는 계산의 텍스트 부분만 표시됩니다(base cost = (2347 + 74×6) × 2.5 = 6977.50);
  • 이미지 도구 호출 과금(≈100,000 quota / ≈$0.20)은 상세 목록에서 빈 행으로 표시되며, 렌더링되지 않습니다;
  • 하지만 하단의 “최종 quota 106977 / $0.213954”에는 정확하게 반영됩니다.
결론: 과금은 정상이고 정확합니다 — 상세 UI가 “이미지 도구” 행을 표시하지 못할 뿐이므로, 각 항목의 합계가 최종 총액과 일치하지 않습니다. 고객에게 설명할 때는 총액은 정확하며, 차이는 이 이미지의 도구 수수료(≈$0.20/image)인데 별도로 항목화되지 않았을 뿐입니다라고 강조하십시오.

비용 참고 사항

  • 생성 비용은 이미지당 고정(≈$0.20/image)이며 prompt 길이에 따라 달라지지 않습니다. 텍스트 token 비용은 이에 비해 작습니다.
  • 각 이미지는 약 60-90초가 걸립니다. 클라이언트 timeout은 ≥300s로 설정하십시오.
  • 이미지만 필요하고 모델이 자율적으로 판단할 필요가 없다면, 독립형 /v1/images/generations 엔드포인트가 더 저렴하고 더 제어하기 쉽습니다.

문제 해결

관련 문서