개요
MAI-Image 2.6은 Microsoft AI의 자체 이미지 생성 모델로, 2026-09-04에 출시되어 Microsoft Foundry에서 퍼블릭 프리뷰로 제공됩니다. 출시 당시 Arena의 텍스트 투 이미지(text-to-image) 및 이미지 편집 부문 모두에서 2위, Artificial Analysis의 이미지 편집 부문에서 1위를 기록했습니다(Microsoft 발표 기준, 2026-09-04 일자). APIYI는 Microsoft 공식 채널을 통해 두 가지 변형 모델을 제공합니다. 두 모델 모두 동일한 엔드포인트와 파라미터를 공유합니다:MAI-Image-2.6: 품질과 정밀도에 최적화된 플래그십 모델입니다MAI-Image-2.6-Flash: 고속 변형 모델입니다. Microsoft에 따르면 GPT-Image-2-Medium보다 2.8배 빠르게 생성되며 높은 처리량이 요구되는 프로덕션 워크로드에 적합합니다
width + height을 통한 자유로운 캔버스 크기 지정(최대 1536×1536 영역), 크기에 관계없이 이미지당 균일한 가격 책정. 1024×1024 이미지는 Flash에서 약 17초, 2.6에서 약 30초가 소요됩니다.텍스트 투 이미지 API
이미지 편집 API
AI 에이전트에게 연동 맡기기
.md 추가), 사용자의 기술 스택에 맞는 코드를 작성합니다. 여기에는 타임아웃, 400을 반환하는 세 가지 파라미터, size 대신 width/height 사용, 파일 업로드 전용 편집 등 자주 발생하는 함정들이 명시되어 있습니다.코딩 에이전트를 통해 MAI-Image 2.6 텍스트 투 이미지 및 이미지 편집 기능을 연동하거나 디버깅합니다. Codex, Claude Code, Cursor 등에 복사하여 붙여넣으십시오.
이 prompt를 통해 방지할 수 있는 문제들
이 prompt를 통해 방지할 수 있는 문제들
APIYI에서 MAI-Image 2.6을 사용해야 하는 이유
Microsoft 공식 채널
/v1/images/generations 및 /v1/images/edits 엔드포인트를 지원하고 OpenAI Images API와 동일한 형태의 응답을 반환합니다.이미지당 정액 과금
어디서나 접근 가능
api.apiyi.com에 직접 연결할 수 있으며, 하나의 키로 모든 모델을 사용할 수 있습니다.다양한 모델 라인업
주요 기능
중국어 텍스트 렌더링
고정밀 편집
사용자 지정 캔버스
width + height 조합이든 지원합니다.두 가지 속도 등급
샘플 결과
중국어 텍스트 렌더링(MAI-Image-2.6-Flash, APIYI 방문을 환영하는 중국어 간판을 요청한 prompt): 간판, 등불, 대련, 칠판 모두 가독성 높은 중국어를 보여줍니다.

MAI-Image-2.6-Flash, “주전자를 짙은 코발트 블루 유약 색상으로 변경하고 나머지는 모두 동일하게 유지해 줘”라는 지시): 왼쪽이 원본, 오른쪽이 결과입니다. 주전자의 색상만 변경되며 치수 라벨 및 기타 개체는 그대로 유지됩니다.

요금
- 크기와 상관없이 이미지당 과금: 768×768과 1536×1536의 비용은 동일하며, prompt 길이는 가격에 영향을 미치지 않습니다.
- 편집 비용은 텍스트-이미지 생성과 동일: 단일 이미지 편집 및 2장 이미지 합성은 각각 이미지 1장으로 과금되며, 편집 엔드포인트의
n=2는 이미지 2장으로 과금됩니다. - 400 오류로 실패한 요청(검열 또는 잘못된 매개변수)은 이미지를 생성하지 않습니다.
- 응답 내
usage필드로 정산 대조를 하지 마십시오:prompt_tokens는 항상 이미지 수 × 1000으로 설정되는 플레이스홀더 값입니다. 콘솔의 과금 내역이 기준이 됩니다. - 충전 보너스 프로모션과 중복 적용됩니다.
그룹 및 Tokens
이 시리즈는Default 그룹에 속해 있습니다. 새로 생성된 모든 token으로 호출할 수 있으며, 별도의 신청은 필요하지 않습니다.
Pay-as-you-go Priority 및 Per-request가 모두 지원됩니다. 동일한 token으로 플랫폼의 token 과금 모델도 함께 사용할 수 있도록 Pay-as-you-go Priority를 권장합니다.요청 속도: 단일 키는 50 RPM 이하로 유지해 주십시오. 대규모 배치 작업의 경우 사전에 지원팀에 문의해 주시기 바랍니다.기술 사양
엔드포인트
주요 파라미터
width 및 height (출력 크기)
n (이미지 수)
- 텍스트-이미지 생성:
n은(는) 적용되지 않습니다. 2, 4 또는 10을 전송해도 1개의 이미지만 반환됩니다(과금도 1건). 더 많은 이미지가 필요한 경우 병렬 요청을 전송하십시오. - 편집:
n이(가) 정상 작동합니다.n=2은(는) 2개의 이미지를 반환하며, 2건으로 과금됩니다.
모범 사례
사용 사례별 모델 변형 선택
MAI-Image-2.6-Flash. 메인 포스터, 복잡한 구도 또는 높은 품질 기준이 필요한 작업 → MAI-Image-2.6. 매개변수가 동일하므로 모델 이름만 변경하여 전환할 수 있습니다.렌더링할 텍스트에 따옴표 사용
편집 시 ‘다른 모든 것은 그대로 유지’ 명시
캔버스 변경 시 이미지 재구성
width / height을 전달하면 모델은 자르거나 패딩하는 대신 장면을 재배치합니다. 로컬 편집의 경우 크기를 생략하면 출력이 16의 배수로 맞춰진 원본 비율을 따릅니다(예: 1344×756 입력 → 1360×768 출력).여러 장의 이미지가 필요한 경우 병렬 요청 전송
오류 코드 및 재시도
429의 경우에만 지수 백오프를 적용하여 최대 3회까지 재시도할 가치가 있습니다. 클라이언트 타임아웃으로 중단된 요청에도 여전히 과금된다는 점에 유의하시고, 먼저 타임아웃 시간을 늘리십시오.자주 묻는 질문 (FAQ)
response_format을 전달하면 왜 400 오류가 반환되나요?
response_format을 전달하면 왜 400 오류가 반환되나요?
b64_json만 반환하며 response_format 파라미터를 허용하지 않습니다. "b64_json"을 전달해도 400 Invalid parameters: response_format이 반환됩니다.gpt-image / DALL·E에서 마이그레이션한 코드에서는 이를 명시적으로 설정하는 경우가 많습니다. 해당 파라미터를 제거하십시오. 이미지는 그대로 data[0].b64_json에 포함되어 반환됩니다. seed 및 negative_prompt도 마찬가지입니다.size: 1536x1024를 전달했는데 왜 결과가 여전히 정사각형인가요?
size: 1536x1024를 전달했는데 왜 결과가 여전히 정사각형인가요?
size을 읽지 않습니다. 이를 무시하고 기본값인 1024×1024로 렌더링합니다. 대신 "width": 1536, "height": 1024을 사용하십시오.편집 엔드포인트에서는 size이 작동하지만, 일관성을 위해 두 엔드포인트 모두에서 width + height을 사용하는 것이 좋습니다.이미지 URL을 사용하여 편집할 수 있나요?
이미지 URL을 사용하여 편집할 수 있나요?
multipart/form-data 파일 업로드만 허용합니다. image에 URL, data URI 또는 base64 문자열을 전달하면 400 오류가 반환됩니다.URL만 있는 경우, 먼저 서버에서 이미지를 다운로드한 후 업로드하십시오:두 장의 참조 이미지는 어떻게 전송하나요? OpenAI SDK는 왜 작동하지 않나요?
두 장의 참조 이미지는 어떻게 전송하나요? OpenAI SDK는 왜 작동하지 않나요?
image2**로 지정하십시오:client.images.edit(image=[f1, f2])은 두 파일을 모두 image[]로 전송합니다. 이 시리즈는 중복된 파일 필드를 허용하지 않아 400 오류를 반환합니다. SDK를 통한 단일 이미지 편집은 정상적으로 작동합니다.마스크 인페인팅이 지원되나요?
마스크 인페인팅이 지원되나요?
mask 필드를 전달하면 400 오류가 반환됩니다. 특정 영역을 수정하려면 prompt에 해당 영역을 설명하십시오(예: “Only make the teapot blue, keep everything else exactly the same”). 테스트 결과 모델은 이러한 제약 조건을 매우 잘 따릅니다.Cherry Studio / LobeChat에서 사용할 수 있나요?
Cherry Studio / LobeChat에서 사용할 수 있나요?
/v1/chat/completions을 사용하므로 이 시리즈에서는 404 오류가 반환됩니다. OpenAI Images API를 지원하는 도구를 사용하거나, 본 문서의 코드 예제를 통해 직접 호출하십시오.요청당 몇 장의 이미지를 생성할 수 있나요?
요청당 몇 장의 이미지를 생성할 수 있나요?
n을 전달하든 1장의 이미지만 수신되며 1장에 대해서만 비용이 청구됩니다. 더 많은 이미지가 필요한 경우 병렬 요청을 전송하십시오.편집 엔드포인트에서는 n가 작동합니다. n=2은 2장의 이미지를 반환하며 2장으로 과금됩니다.usage의 token 수로 과금 내역을 확인할 수 있나요?
usage의 token 수로 과금 내역을 확인할 수 있나요?
usage.prompt_tokens은 항상 1000 × 이미지 수이고 output_tokens는 항상 0이며, 이는 임시 플레이스홀더 값입니다. 이 시리즈는 이미지당 과금되며, APIYI 콘솔의 청구 내역이 기준이 됩니다.콘텐츠 검열은 얼마나 엄격한가요? 차단 시 어떻게 표시되나요?
콘텐츠 검열은 얼마나 엄격한가요? 차단 시 어떻게 표시되나요?
400 content_safety_violation이 반환되며 메시지에 구체적인 사유가 포함됩니다. prompt 수준의 차단은 일반적으로 5~8초 이내에 반환되며, 생성 후 적용되는 일부 차단은 일반적인 이미지 생성과 거의 동일한 시간이 소요됩니다. 동일한 prompt로 재시도해도 해결되지 않으므로 prompt를 다시 작성하십시오.스트리밍이 지원되나요?
스트리밍이 지원되나요?
503 no available channels 오류가 발생하나요?
503 no available channels 오류가 발생하나요?
MAI-Image-2.6 또는 MAI-Image-2.6-Flash이어야 하며, mai-image-2.6-flash은 503을 반환합니다.관련 문서
- MAI-Image 2.6 텍스트 투 이미지 API - Playground가 포함된 API 레퍼런스
- MAI-Image 2.6 이미지 편집 API - 참조 이미지 편집 및 두 이미지 합성
- 이미지 API 필수 사항 및 모범 사례 - 타임아웃, 연결 끊김, 압축
- 충전 보너스 프로모션