Skip to main content

개요

Grok Imagine 2는 xAI의 최신 2세대 이미지 모델로, 파라미터 제어와 편집 모두에서 첫 출시 버전보다 한 세대 완전히 발전했습니다. 종횡비와 해상도가 실제로 적용되고, 2K 티어를 사용할 수 있으며, 한 번의 호출로 최대 10장의 이미지를 반환하고, 참조 편집은 원본 이미지를 충실히 보존합니다. APIYI는 grok-imagine-image(표준) 및 grok-imagine-image-quality(고품질)의 두 가지 변형을 제공합니다. 두 모델은 동일한 엔드포인트와 파라미터를 공유하며, 출력 품질과 가격만 다릅니다.
🔒 이 모델군은 기본적으로 공개되지 않으며, 전용 Grok_imagine 그룹에 대한 액세스가 필요합니다Grok Imagine 2는 완전히 통합되어 안정적으로 제공되지만, Default 그룹에 속하지는 않습니다. 콘텐츠 안전 정책이 플랫폼의 다른 모델과 크게 다르며, 일부 카테고리는 필터링되지 않으므로 컴플라이언스 위험을 제한하기 위해 선택적으로 액세스를 부여합니다.
  • 누적 지출액이 $1,000 이상인 기존 고객: 지원팀에 문의하여 사용 사례를 설명하면, 확인 후 활성화해 드립니다
  • 그 외 모든 사용자: WeCom 지원을 통해 사용 사례와 콘텐츠 조정 제어 방식을 설명하여 신청하세요. 요청이 승인되면 계정에 활성화해 드립니다
Grok_imagine 그룹이 없는 토큰으로 모델을 호출하면 **503**이 반환됩니다. 이는 장애가 아닌 권한 문제입니다. 신청 및 구성 방법은 아래의 그룹 설정을 참조하세요.
주요 특징: 해상도와 무관한 요청당 고정 가격(xAI는 2K 품질 티어를 $0.07로 책정하지만, 당사는 어느 경우든 $0.045를 청구하며 이는 정가의 약 **64%**입니다), 실제로 적용되는 5가지 종횡비 x 2가지 해상도 티어, 호출당 최대 10장 이미지, 그리고 아트 스타일·구성·팔레트·피사체 정체성을 보존하는 고충실도 참조 편집을 제공합니다. 1K 이미지는 약 9초가 소요됩니다.
모델 ID에는 2가 포함되지 않습니다. 제품명은 Grok Imagine 2이지만, 호출하는 모델명은 grok-imagine-image 및 **grok-imagine-image-quality**입니다. 존재하지 않는 모델이므로 503을 반환하는 grok-imagine-2-image를 입력하지 마세요.
📌 먼저 읽어 보세요: 참조 이미지는 편집 엔드포인트 /v1/images/edits에서만 작동하며, 텍스트-이미지 생성에서는 절대 작동하지 않습니다.image / image_url / images를 /v1/images/generations에 전달하면 정상적인 이미지와 함께 200이 반환되지만, 참조 이미지는 조용히 폐기되고 여전히 과금됩니다. 어떠한 오류도 표시되지 않습니다. 아래의 엔드포인트를 참조하세요.
모든 이미지 API는 동기식입니다. 비동기 작업 ID가 없으므로 클라이언트 연결이 끊기면 요청은 계속 과금되는 동안 결과를 잃게 됩니다. 충분히 긴 timeout을 설정하세요. 이미지 API 모범 사례를 참조하세요.

텍스트-이미지 생성 API

텍스트 prompt로 이미지를 생성하며, 실시간 테스트를 위한 인터랙티브 Playground를 제공합니다.

이미지 편집 API

참조 이미지와 지시문을 업로드하며, 1~4장 이미지 융합 및 Playground를 제공합니다.

AI 에이전트에게 통합을 맡기십시오

Codex / Claude Code / Cursor로 작업하는 경우 아래 프롬프트를 복사하여 에이전트에게 넘기십시오. 에이전트는 먼저 이 페이지의 일반 텍스트 버전을 가져오고(임의의 docs URL 뒤에 .md를 추가하십시오), 그다음 프로젝트의 자체 스택에서 코드를 작성합니다 — 타임아웃, URL 결과의 즉시 재호스팅, 참조 이미지를 조용히 버리면서도 과금은 계속하는 엔드포인트, 그리고 size가 아무 일도 하지 않는다는 사실은 이미 요구사항에 반영되어 있습니다.

코딩 에이전트가 Grok Imagine 2 텍스트-이미지 및 이미지 편집을 통합하거나 문제를 해결하게 하십시오. Codex, Claude Code, Cursor 및 유사 도구에 복사하여 붙여넣으십시오.

APIYI에서 Grok Imagine 2를 사용하는 이유

OpenAI 호환 형식

표준 /v1/images/generations 및 /v1/images/edits 엔드포인트입니다. 요청 본문과 응답 필드는 OpenAI 이미지 API와 일치하므로 공식 OpenAI SDK를 바로 사용할 수 있습니다 — 이전 작업이 전혀 필요하지 않습니다.

동시 실행 수 제한 없음

RPM/RPD 하드 제한이 없습니다. 100 RPM에서도 여유 있게 측정되었습니다. 채널 용량도 충분하여 배치 워크로드는 선형적으로 확장되며 — 쿼터 요청이나 자체 스로틀링이 필요하지 않습니다.

정액 요금, 예측 가능한 비용

이미지당 고정 요금이며, 해상도와 무관합니다: xAI는 1K에 $0.05, 2K에 $0.07의 품질 등급을 제시하지만, 저희는 일괄 $0.045를 청구합니다 — 2K 기준 공시가의 약 64%입니다. 정확한 이미지 수에 맞춰 예산을 책정하고, 충전 보너스를 함께 활용하면 더 낮출 수 있습니다.

글로벌 접근, 장벽 없음

해외 서버나 프록시가 필요하지 않습니다. 중국 본토 데이터 센터, 가정용 브로드밴드 및 해외 노드 모두 api.apiyi.com에 직접 연결됩니다.

완전한 모델 생태계

추가로 이용 가능합니다: Nano Banana 2, GPT-Image-2, Seedream, FLUX, 그리고 Grok 텍스트 모델.

전문 지원

저희 팀은 이미지 생성 워크로드에 깊이 있게 대응하며, PoC부터 프로덕션 롤아웃까지 기업 고객을 지원할 수 있습니다.

주요 기능

두 가지 해상도 티어

1k는 대략 1메가픽셀, 2k는 4.2-4.5메가픽셀(16:9 기준 2816x1584)입니다 — 가격은 같으므로 2K가 더 유리합니다

5가지 화면 비율

1:1 / 16:9 / 9:16 / 4:3 / 3:4, 측정된 픽셀 크기가 정확히 일치합니다

한 번의 호출당 최대 10개

n은 1-10개를 허용하며, 한 요청으로 여러 이미지를 반환합니다 — 배치 선택에 이상적입니다

빠른 생성

1K에서는 약 9초, 2K에서는 15-17초가 걸리며, 부하가 걸려도 지연 시간이 안정적입니다 — 100 RPM으로도 무난히 운용됩니다

진정한 레퍼런스 편집

요청하신 부분만 변경합니다 — 아트 스타일, 구도, 팔레트, 피사체 정체성은 그대로 유지됩니다

다중 이미지 융합

편집 엔드포인트는 1-4개의 레퍼런스를 받습니다 — 테스트에서는 각 레퍼런스가 하나의 피사체를 추가하며, 첫 번째가 출력 크기를 결정합니다

두 가지 응답 형식

url 직접 링크 또는 b64_json 원시 base64를 지원하며, 두 엔드포인트 모두에서 사용할 수 있습니다

OpenAI SDK 바로 사용 가능

client.images.generate() 및 client.images.edit()은 바로 사용할 수 있습니다 — 수동 HTTP 연동이 필요 없습니다

요금

과금 관련 참고사항
  • 저희는 해상도를 무시하지만, xAI는 그렇지 않습니다. xAI는 1K를 $0.05, 2K를 $0.07의 품질 등급으로 정가에 올려두는 반면, APIYI는 일률적으로 $0.045를 청구합니다. 따라서 해상도가 높을수록 절감액이 더 커지며, 2K에서는 정가의 약 **64%**까지 내려갑니다.
  • 이미지당: n=4은 prompt 길이와 관계없이 4개 이미지로 청구됩니다.
  • 편집 비용은 text-to-image와 동일합니다 — /v1/images/edits에는 추가 요금이 없습니다.
  • usage 블록은 정산에 사용할 수 없습니다: prompt_tokens는 항상 1000 x n이며, 자리표시자입니다. 대신 콘솔 과금 기록을 사용하십시오.

충전 보너스 적용 시 실효 비용

이 할인은 단계별 충전 보너스와 중복 적용됩니다(누적이 아니라 단일 충전 기준으로 계산됩니다). 품질 등급을 2K로 잡으면:
일반적인 경우($100 등급)에는 2K 이미지가 xAI 정가의 약 58% 수준이며, 최대 보너스에서는 약 54%까지 내려갑니다. 표준 grok-imagine-image도 같은 방식으로 중복 적용되며 — 정가 $0.02는 20% 보너스에서 이미지당 약 $0.0167이 됩니다.

그룹 설정

Grok Imagine 2는 Default 그룹에 포함되지 않으며 기본적으로 활성화되지 않습니다. 자체 **Grok_imagine 그룹(요율 1.0배, 위의 가격표와 동일)**에서 제공되며, 액세스 권한을 요청해야 합니다.
별도 그룹으로 운영하는 이유: 이 모델 제품군의 콘텐츠 안전 정책은 플랫폼의 다른 모델과 크게 다르며, 일부 카테고리는 필터링되지 않습니다. 규정 준수 위험을 제한하기 위해 모든 계정에서 액세스할 수 있는 기본 그룹에서 제외하고, 선택적으로 액세스 권한을 부여합니다.

액세스 권한을 받을 수 있는 사용자

신청 방법

1

WeCom 지원팀에 문의

WeCom 지원팀을 통해 신청하거나 [email protected]으로 이메일을 보내십시오.
2

사용 사례와 조정 제어 방법을 설명

다음 세 가지 사항을 포함하십시오. 이미지가 어떤 제품에 사용되는지, 최종 사용자가 누구인지, 그리고 귀사에서 어떤 콘텐츠 조정 및 사람에 의한 검토를 수행하는지 설명해야 합니다. 요청 내용이 구체적일수록 검토가 빨리 진행됩니다.
3

Token을 그룹으로 전환

승인되면 계정에서 Grok_imagine을 활성화합니다. 콘솔의 Token 페이지로 이동하여 이 모델 제품군에 사용하는 Token을 Grok_imagine으로 전환하고, 과금 모델을 Pay-as-you-go Priority 또는 Pay-per-request로 설정하십시오.
액세스 권한이 부여되기 전의 동작: Grok_imagine 그룹이 없는 Token은 **503 (현재 그룹에서 사용 가능한 채널이 없음)**을 반환합니다. 다시 시도해도 해결되지 않습니다. 먼저 그룹을 활성화해야 합니다.권장 Token 과금 모델: Pay-as-you-go Priority. 이 모델 제품군은 요청별로 과금되며, 종량제 우선과 요청당 결제 모두 올바르게 라우팅됩니다. 종량제 우선을 선택하면 하나의 Token으로 플랫폼의 다른 token 기반 모델까지 사용할 수 있습니다.
규정 준수 안내: 액세스 권한이 부여되면 생성된 콘텐츠에 대한 책임은 호출자에게 있습니다. 사용자에게 적용되는 법률을 준수하고, 불법 콘텐츠, 타인의 초상권 또는 지적 재산권을 침해하는 콘텐츠, 미성년자에게 부적절한 자료를 생성하지 마십시오. 소비자 대상 배포의 경우 귀사 측에 추가적인 콘텐츠 조정 계층을 마련하는 것이 좋습니다. 참고 자료: 해외 모델 호출 시 규정 준수. 악용이 확인되면 그룹 액세스 권한이 취소됩니다.

기술 사양

엔드포인트

✅ 편집 엔드포인트는 multipart/form-data 파일 업로드가 필요합니다/v1/images/edits에 JSON을 전송하면 항상 400이 반환됩니다:
이 점은 상위 공급업체의 문서에서 통합하는 경우 특히 중요합니다 — 그 문서에는 공개 이미지 URL이 포함된 JSON 본문이 설명되어 있지만, 이는 APIYI 게이트웨이를 통해서는 작동하지 않습니다. 대신 이 페이지를 따르십시오: -F "[email protected]"로 파일을 업로드하십시오. 전체 예시는 이미지 편집 API에서 확인할 수 있습니다.파일 필드 이름은 image 또는 image[]여야 하며, images / image_file는 415를 반환합니다.
⚠️ 참고 이미지는 절대로 텍스트를 이미지로 엔드포인트에 보내지 마십시오/v1/images/generations가 image / image_url / images를 받으면, 오류를 발생시키지 않습니다. 200을 반환하고 참고 이미지는 완전히 무시한 채 프롬프트만으로 새 이미지를 생성합니다. — 그리고 평소처럼 과금됩니다.오류 신호가 없기 때문에, 보통은 결과가 입력과 전혀 관련이 없다는 사실을 누군가 알아차릴 때만 드러납니다. 참고 이미지를 사용하는 모든 워크플로는 /v1/images/edits를 사용해야 합니다.
기본 도메인은 https://api.apiyi.com이며, 백업은 https://vip.apiyi.com입니다. 채팅형 생성(/v1/chat/completions)도 동작하지만 권장 경로는 아닙니다 — 아래 FAQ를 참조하십시오.

GPT-Image-2에서 마이그레이션

이미 GPT-Image-2를 통합한 경우 엔드포인트와 호출 규약은 동일합니다(/v1/images/generations + /v1/images/edits, OpenAI SDK 호환). 하지만 매개변수 시스템은 다르므로 모델 이름만 바꾸는 것으로는 작동하지 않습니다. 변경해야 하는 사항은 다음과 같습니다.

매개변수 매핑

이 표에서는 GPT-Image-2를 기준으로 사용합니다. gpt-image-2.5-flare / gpt-image-2.5-sunburst도 동일한 매개변수를 공유하므로 매핑이 동일하게 적용됩니다.

가장 쉽게 발생하는 세 가지 실수

1. 기본 응답 형식이 반대입니다 — 가장 자주 놓치는 변경 사항GPT-Image-2는 b64_json만 반환합니다(url는 없음). 반면 Grok Imagine 2는 기본적으로 url를 반환합니다. 파서가 resp.data[0].b64_json을 읽는 경우, 마이그레이션 후에는 None / undefined을 받게 됩니다.다음 두 가지 수정 방법 중 하나를 선택합니다.
  • 기존 코드 유지 → "response_format": "b64_json"을 명시적으로 전달합니다
  • 직접 링크로 전환 → data[0].url을 읽고 다운로드합니다
또한 GPT-Image-2의 usage에는 실제 token 수가 포함되지만, Grok Imagine 2의 usage는 자리 표시자입니다(항상 1000 x n). usage를 기반으로 작성된 비용 보고 스크립트는 마이그레이션 후 잘못된 수치를 생성합니다.
2. size은 오류 대신 조용히 실패합니다GPT-Image-2는 엄격하게 검증하며 잘못된 입력에 대해 일반적으로 400을 반환합니다. Grok Imagine 2는 허용 범위가 넓습니다. size, quality, style과 같은 OpenAI 스타일 필드는 조용히 무시되고, 잘못된 aspect_ratio / resolution 값은 조용히 기본값으로 대체됩니다.따라서 model만 변경하고 size: "1536x1024"를 제거하는 것을 잊으면 요청은 1024x1024 정사각형 이미지를 포함한 200 응답을 반환합니다. 매개변수가 무시되었다는 알림은 전혀 표시되지 않습니다.마이그레이션 후 첫 번째 호출에서 출력 픽셀 크기를 확인하여 aspect_ratio / resolution가 실제로 적용되었는지 확인합니다.
3. 참조 이미지는 더 이상 텍스트-이미지 엔드포인트로 전송할 수 없습니다이 문제는 이 모델에만 해당합니다. 참조 이미지를 /v1/images/generations로 전송하면 200을 반환하고 참조 이미지를 조용히 버리지만 과금은 그대로 이루어집니다. 모든 참조 이미지 호출은 multipart/form-data과 함께 /v1/images/edits을 사용해야 합니다 — 위의 엔드포인트를 참조하십시오.

변경 전과 변경 후

어떤 것을 사용해야 합니까? 마스크 인페인팅, 픽셀 단위로 정확한 사용자 지정 크기 또는 최대 16개의 참조 이미지 결합이 필요한 경우 GPT-Image-2를 계속 사용하십시오. 예측 가능한 비용(이미지당 정액, 2K 추가 요금 없음), 호출당 여러 이미지(n 최대 10개) 또는 편집 시 높은 원본 충실도가 필요한 경우 Grok Imagine 2를 선택하십시오. 두 모델은 함께 사용할 수 있으며 — 동일한 Token 호출로 두 모델을 모두 사용할 수 있습니다.

핵심 매개변수

aspect_ratio 및 resolution (출력 크기)

이 둘이 함께 실제 출력 픽셀을 결정합니다. 측정값은 요청과 정확히 일치합니다:
두 매개변수는 텍스트-투-이미지에만 적용됩니다. /v1/images/edits에서는 오류 없이 허용되지만 효과는 없습니다 — 편집된 출력은 항상 첫 번째 참조 이미지의 크기와 일치합니다(입력이 1280x720이면 출력도 1280x720이며, fusion 세트의 순서를 바꾸면 출력이 새 첫 번째 이미지를 따르도록 바뀝니다). 출력 크기를 변경하려면 업로드하기 전에 참조 이미지를 자르거나 크기를 조정하십시오.
검증은 관대합니다 — 오타가 있어도 오류를 발생시키지 않습니다. aspect_ratio의 열거형 밖 값(예: 5:7, 21:9)이나 resolution의 열거형 밖 값(예: 1K, 1024x1024)은 조용히 기본값으로 되돌아가며 여전히 이미지를 반환합니다. 잘못된 response_format도 마찬가지로 url로 되돌아갑니다. 따라서 출력이 예상과 다를 때는 먼저 매개변수 철자를 확인하십시오.유일한 예외는 resolution: "4k"이며, 이 경우 503 model_service_unavailable를 반환합니다. 이는 티어가 지원되지 않는다는 뜻이지 채널이 다운되었다는 뜻이 아닙니다 — 1k / 2k로 다시 전환하십시오.

n (호출당 이미지 수)

1-10을 허용합니다. 반환된 data 배열의 길이는 n와 같으며, 각 이미지는 과금됩니다. 0은 조용히 1으로 처리되며, 11 이상이면 400을 반환합니다.

권장 사항

1

미리 결정하십시오: 생성인가 편집인가?

참조 이미지가 없으면 → /v1/images/generations. 참조 이미지가 하나라도 있으면, 한 픽셀 수정하는 경우라도 → /v1/images/edits. 잘못된 엔드포인트를 선택해도 오류는 발생하지 않고, 예상과 다른 이미지가 나올 뿐입니다.
2

클라이언트 타임아웃을 360초로 설정하십시오

이미지 API는 동기식입니다. 2K는 15~17초가 걸리며, 트래픽이 몰릴 때나 콜드 스타트 시에는 더 오래 걸릴 수 있습니다. 60초 타임아웃은 이미 과금되는 요청에서 불필요한 실패를 일으킵니다.
3

prompt가 아니라 aspect_ratio로 구도를 제어하십시오

이 매개변수는 실제로 작동하므로, aspect_ratio: "16:9"이 prompt에서 “가로형 구도”를 요청하는 것보다 훨씬 더 안정적입니다.
4

대역폭에 따라 해상도 등급을 선택하십시오

2K는 이미지당 5-6 MB의 무손실 PNG이며, 1K는 220-300 KB의 JPEG입니다 — 대략 20배 차이입니다. 모바일이나 대량 전송에는 1K를 권장합니다. 두 등급의 비용이 같으므로, 선택은 순전히 화질과 대역폭의 문제입니다.
5

편집할 때는 «나머지는 모두 그대로 두십시오»라고 말하십시오

“스카프를 빨간색으로 바꾸되, 나머지는 모두 정확히 그대로 두십시오”와 같은 지시는 매우 잘 작동합니다 — 모델이 이 제약을 매우 잘 따르고 이미지의 나머지 부분을 보존합니다.
6

합성할 때는 이미지를 명시적으로 참조하십시오

image[] 업로드 순서가 “image 1 / image 2 / image 3”의 의미입니다. “image 1의 주체를 image 2의 장면에 넣으십시오”라고 쓰는 것이 모델에게 추측하게 두는 것보다 훨씬 더 안정적입니다.
7

재현성을 위해 seed에 의존하지 마십시오

이 계열은 seed를 지원하지 않으므로; 같은 prompt라도 호출마다 다른 결과가 나옵니다. 다시 생성될 것을 기대하기보다, 유지할 이미지는 저장해 두십시오.
8

배치 작업은 그냥 동시 처리하십시오

동시 실행 수 제한은 없습니다 — 100 RPM이면 충분한 채널 용량으로도 여유 있게 처리됩니다. 직렬 큐를 만들거나 추가 쿼터를 요청할 필요가 없습니다.

오류 코드 및 재시도

클라이언트 안내: 400 및 415는 결정적 오류입니다 — 재시도는 무의미하므로 대신 알림을 보내십시오. 429 및 네트워크 계층 타임아웃만 재시도할 가치가 있으며, 지수 백오프를 적용하고 최대 3회만 시도하십시오.400 invalid_request은 “잘못된 파라미터”와 “콘텐츠 차단”을 모두 포함하며, 응답 본문만으로는 둘을 구분할 수 없습니다. 실용적인 휴리스틱은 지연 시간입니다. 모더레이션 차단은 생성이 시작되기 전에 발생하므로 성공적인 생성(9초)보다 빠른 약 56초 내에 반환됩니다.

자주 묻는 질문

먼저 어떤 503인지 확인해야 합니다. resolution: "4k"를 전달하면 해당 티어가 지원되지 않는다는 의미입니다(아래 항목 참조). 파라미터에 문제가 없고 503이 계속 발생한다면, 해당 토큰에 Grok_imagine 그룹이 없을 가능성이 매우 높습니다.이 제품군은 기본적으로 공개되지 않습니다. 콘텐츠 안전 정책이 플랫폼의 다른 모델과 크게 다르고 일부 카테고리는 필터링되지 않으므로, 컴플라이언스 위험을 제한하기 위해 별도의 Grok_imagine 그룹으로 유지하며 선택적으로 액세스를 부여합니다. 누적 지출이 $1,000 이상인 기존 고객은 지원팀에 사용 사례를 설명하여 활성화할 수 있습니다. 그 외 사용자는 사용 사례와 적용 중인 콘텐츠 검토 제어 방안을 설명하여 WeCom 지원을 통해 신청할 수 있습니다.전체 절차는 위의 그룹 설정을 참조하십시오.
APIYI 게이트웨이의 편집 엔드포인트는 multipart/form-data만 허용하는 반면, 업스트림 벤더 문서에서는 공개 이미지 URL이 포함된 JSON 본문을 설명하기 때문입니다. 둘은 다르므로 이 사이트의 문서를 따르십시오.올바른 형식은 파일 업로드입니다.
장점은 이미지 호스팅이 필요 없다는 것입니다. 로컬 파일을 직접 업로드할 수 있으므로 공개 URL을 준비하는 것보다 간단합니다. 전체 예시는 이미지 편집 API를 참조하십시오.
이는 예상된 동작이며, 이 모델에서 가장 흔한 함정입니다. /v1/images/generations는 image / image_url / images을 조용히 무시하고 prompt만으로 생성하며, 평소와 같이 과금됩니다.오류 신호가 없으므로 “편집이 작동하지 않는다”고 판단하기 쉽습니다. 참조 이미지를 사용하는 모든 워크플로는 반드시 /v1/images/edits를 사용해야 합니다.
편집된 출력 크기는 입력 참조 이미지를 따릅니다. 1280x720을 입력하면 1280x720이 출력되고, 1024x1024를 입력하면 1024x1024가 출력됩니다. 여기서 resolution 또는 aspect_ratio을 전달해도 오류는 발생하지 않지만 아무런 효과가 없습니다.출력 크기를 변경하려면 업로드 전에 참조 이미지를 자르거나 크기를 조정하십시오.
이 제품군은 revised_prompt을 반환하지 않으며, respect_moderation 또는 model 같은 필드도 반환하지 않습니다. 각 data[] 항목에는 response_format에 따라 url 또는 b64_json 중 하나만 포함되며, 둘 다 포함되는 경우는 없습니다.응답을 파싱할 때 이러한 필드가 존재한다고 가정하지 마십시오.
아니요. usage.prompt_tokens은 실제 prompt 길이와 관계없이 항상 1000 x n이며, 이는 자리 표시자입니다.이 제품군은 이미지당 고정 요율로 요청별 과금됩니다. 실제 청구 금액은 APIYI 콘솔의 과금 기록을 사용하십시오.
이는 업스트림 동작입니다. resolution: 1k은 JPEG(~220-300 KB)를 반환하고, resolution: 2k은 무손실 PNG(~5-6 MB)를 반환하므로 약 20배 차이가 납니다.URL 확장자, HTTP Content-Type 및 실제 바이트는 서로 일치하므로 Content-Type을 기준으로 안전하게 분기할 수 있습니다.대역폭에 민감한 시나리오(모바일, 대량 전송)에서는 1k을 권장합니다. 두 티어의 비용은 같으므로 선택은 순전히 품질에 관한 문제입니다. 반대로 품질이 필요한 경우 2k에는 추가 요금이 없으며 정가 대비 더 큰 할인율이 적용됩니다.
아니요. 4k은 이 제품군에서 지원되는 티어가 아니며, 게이트웨이는 503 model_service_unavailable을 반환합니다. 이 코드는 장애처럼 보이지만 실제로는 파라미터 문제이므로 재시도해도 해결되지 않습니다. 1k 또는 2k으로 되돌리십시오.1k 및 2k만 지원됩니다.
이 제품군의 검증은 느슨합니다. 잘못된 aspect_ratio(예: 5:7), resolution(예: 1K, 1024x1024) 및 response_format(예: base64)은 모두 조용히 기본값으로 대체되며, 400 대신 이미지를 계속 반환합니다.따라서 출력이 예상과 일치하지 않으면 먼저 파라미터 철자를 확인하십시오. 특히 resolution 값은 소문자인 1k / 2k입니다.
n는 1-10을 허용하며, 반환되는 data 배열 길이는 n와 같습니다. 각 이미지마다 과금됩니다.0은 조용히 1으로 처리되며, 11 이상은 400 invalid_request을 반환합니다.
아니요. seed을 전달해도 오류는 발생하지 않지만 효과가 없습니다. 동일한 seed로 같은 prompt를 사용해도 호출마다 다른 이미지가 반환됩니다.다시 생성하려고 시도하기보다 재사용해야 하는 이미지는 저장해 두십시오.
예. 두 엔드포인트는 OpenAI Images API와 호환됩니다. base_url을 https://api.apiyi.com/v1으로 지정하면 됩니다.
aspect_ratio 및 resolution은 표준 OpenAI SDK 필드가 아니므로 extra_body을 통해 전달해야 합니다.
동시 실행 수 제한은 없습니다. 충분한 채널 용량을 바탕으로 429나 큐 거부 없이 100 RPM에서 안정적으로 측정되었습니다. 직렬 큐를 구축하거나 추가 쿼터를 요청하지 않고 동시 호출할 수 있습니다.실제로 중요한 것은 **timeout**입니다. 이미지 API는 동기식이므로, 정상 처리 중인 요청이 중단되지 않도록 클라이언트 timeout을 360초로 설정하십시오. 이러한 요청도 계속 과금됩니다.
이 제품군은 콘텐츠 검토를 적용합니다. 차단된 요청은 파라미터 오류와 정확히 동일한 오류 코드 및 메시지를 사용하여 400 invalid_request을 반환하므로, 응답 본문만으로는 구분할 수 없습니다.실용적인 휴리스틱은 지연 시간입니다. 검토 차단은 생성 전에 차단되므로 약 5-6초 안에 반환되는 반면, 성공한 이미지는 약 9초가 걸립니다. 검토 결과에는 일부 무작위성도 있으므로 경계선 콘텐츠는 재시도마다 동일하게 동작하지 않을 수 있습니다. 한 번의 시도만으로 결론을 내리지 마십시오.파라미터가 올바른 것으로 확인되었는데도 400이 계속된다면, prompt가 콘텐츠 검토를 트리거했을 가능성이 높습니다. 표현을 수정하십시오.
예, 하지만 권장되는 경로는 아닙니다. 이 엔드포인트는 content이 마크다운 이미지 링크인 표준 chat 구조를 반환합니다.
이는 Chatbox 또는 LobeChat과 같은 대화형 클라이언트에 적합합니다. 프로그래밍 방식의 통합에는 Images API(/v1/images/generations 및 /v1/images/edits)를 사용하십시오. 더 풍부한 파라미터, 더 안정적인 응답 형식, 그리고 이 문서와의 일관성을 제공합니다.

관련 문서