概要
MAI-Image 2.6は、Microsoft AIが独自開発した画像生成モデルであり、2026-09-04にリリースされ、Microsoft Foundryにてパブリックプレビューとして利用可能です。リリース時、Arenaのテキストからの画像生成および画像編集の両部門で第2位、Artificial Analysisの画像編集部門で第1位を獲得しました(2026-09-04時点、Microsoftの発表による)。 APIYIでは、Microsoftの公式チャネルを通じて2つのバリアントを提供しています。両バリアントとも同じエンドポイントとパラメーターを共有します。MAI-Image-2.6: 品質と精度を重視して調整されたフラグシップモデルMAI-Image-2.6-Flash: 高速バリアント。MicrosoftによるとGPT-Image-2-Mediumより2.8倍高速に生成でき、高スループットな本番ワークロードに適しています
width + height による自由なキャンバス指定(最大1536×1536の領域まで)、そしてサイズに関係のない画像1枚あたりの定額課金です。1024×1024の画像生成にかかる時間は、Flashで約17秒、2.6で約30秒です。テキストからの画像生成API
画像編集API
AIエージェントに統合を任せる
.md を追加)、お使いの技術スタックに合わせたコードを作成します。タイムアウト、400 を返す3つのパラメータ、size の代わりに width/height を使用すること、ファイルアップロード限定の編集など、よくある落とし穴が明記されています。コーディングエージェントに MAI-Image 2.6 のテキストからの画像生成および画像編集を統合またはデバッグさせます。Codex、Claude Code、Cursor などにコピー&ペーストしてください。
この prompt で回避できる落とし穴
この prompt で回避できる落とし穴
APIYI で MAI-Image 2.6 を利用する理由
Microsoft 公式チャネル
/v1/images/generations および /v1/images/edits エンドポイントに対応しており、OpenAI Images API と同様の形式でレスポンスが返されます。画像単位の料金設定
どこからでもアクセス可能
api.apiyi.com にアクセスでき、1つのキーですべてのモデルを利用可能です。充実したモデルラインナップ
主な機能
中国語テキストのレンダリング
高精度な編集
カスタムキャンバス
width + heightの組み合わせに対応し、長辺は最大3072(例:3072×768のバナー)、総面積の上限は1536×1536です。2つの速度ティア
サンプル結果
中国語テキストのレンダリング(MAI-Image-2.6-Flash、APIYIへの来訪者を歓迎する中国語の看板を指定したprompt):看板、提灯、対聯、黒板のすべてにおいて判読可能な中国語が表示されています。

MAI-Image-2.6-Flash、指示:「ティーポットを濃いコバルトブルーの釉薬に変更し、その他はすべて同じに保つ」):左が元画像、右が結果です。ティーポットの色のみが変更され、寸法ラベルやその他のオブジェクトは変更されていません。

料金
- サイズに関わらず画像1枚あたり:768×768と1536×1536は同じ料金であり、promptの長さは価格に影響しません。
- 編集はテキストからの画像生成と同額:1枚の画像編集および2枚の画像合成はそれぞれ画像1枚として課金されます。編集エンドポイントでの
n=2は画像2枚分として課金されます。 - 400エラーで失敗したリクエスト(モデレーションまたは無効なパラメータ):画像は生成されません。
- レスポンスの
usageフィールドと照合しないでください:prompt_tokensは常に「画像数 × 1000」のプレースホルダーです。コンソールの課金情報が正式なものとなります。 - チャージボーナスプロモーションと併用可能です。
グループと Tokens
このシリーズは**Default グループ**に属しています。新規作成されたすべての token で呼び出すことができ、申請は不要です。
Pay-as-you-go Priority と Per-request の両方をご利用いただけます。プラットフォーム上の token 課金モデルでも同じ token を利用できるよう、Pay-as-you-go Priority を推奨します。レート: 単一キーは 50 RPM 未満に抑えてください。大規模なバッチワークロードの場合は、事前にサポートまでお問い合わせください。技術仕様
エンドポイント
主要パラメータ
width および height(出力サイズ)
n(画像枚数)
- テキストから画像生成:
nは効果がありません。2、4、または10を指定して送信しても1枚の画像のみが返されます(課金も1枚分)。さらに必要な場合は並列リクエストを送信してください。 - 編集:
nは機能します。n=2は2枚の画像を返し、2枚分として課金されます。
ベストプラクティス
ユースケースに応じてバリアントを選択する
MAI-Image-2.6-Flash。ヒーローポスター、複雑な構図、または高い品質基準が求められる場合 → MAI-Image-2.6。パラメータは同一であるため、切り替えはモデル名を変更するだけです。描画したいテキストを引用符で囲む
編集時は「その他はすべてそのまま変更しない」と指定する
キャンバスを変更すると画像が再構成される
width / height を渡すと、モデルはクロップ(切り抜き)やパディングを行うのではなく、シーンを再レイアウトします。部分的な編集の場合はサイズ指定を省略すると、出力は16の倍数にスナップされた元の比率に従います(例: 1344×756の入力 → 1360×768の出力)。複数の画像が必要な場合は並行リクエストを送信する
エラーコードとリトライ
429のみであり、指数バックオフを用いて最大3回までに留めてください。クライアント側のタイムアウトにより破棄されたリクエストも課金対象となる点に注意し、まずはタイムアウト値を長めに設定してください。FAQ
response_format を送信すると 400 が返されるのはなぜですか?
response_format を送信すると 400 が返されるのはなぜですか?
b64_json のみを返し、response_format パラメーターを受け付けません。"b64_json" であっても 400 Invalid parameters: response_format が返されます。gpt-image や DALL·E から移行したコードでは明示的に設定されていることがよくあります。削除してください。画像は引き続き data[0].b64_json に含まれます。seed および negative_prompt についても同様です。size: 1536x1024 を渡したのに、結果が正方形のままなのはなぜですか?
size: 1536x1024 を渡したのに、結果が正方形のままなのはなぜですか?
size を読み取りません。暗黙的に無視され、デフォルトの 1024×1024 でレンダリングされます。代わりに "width": 1536, "height": 1024 を使用してください。編集エンドポイントでは size は機能しますが、一貫性を保つため両方で width + height を使用してください。画像 URL を使用して編集できますか?
画像 URL を使用して編集できますか?
multipart/form-data ファイルのアップロードのみを受け付けます。URL、data URI、または base64 文字列を image として渡すと 400 が返されます。URL しかない場合は、まずサーバー側でダウンロードしてからアップロードしてください。2 枚の参照画像を送信するにはどうすればよいですか? OpenAI SDK が動作しないのはなぜですか?
2 枚の参照画像を送信するにはどうすればよいですか? OpenAI SDK が動作しないのはなぜですか?
image2 にしてください。client.images.edit(image=[f1, f2]) は、両方のファイルを image[] として送信します。このシリーズは重複したファイルフィールドを受け付けず、400 を返します。SDK を使用した単一画像の編集は問題なく動作します。マスクインペインティングはサポートされていますか?
マスクインペインティングはサポートされていますか?
mask フィールドを指定すると 400 が返されます。部分的な変更を行うには、prompt 内で領域を指定してください(例: 「Only make the teapot blue, keep everything else exactly the same」など)。弊社のテストでは、モデルはこのような制約に忠実に従います。Cherry Studio / LobeChat で使用できますか?
Cherry Studio / LobeChat で使用できますか?
/v1/chat/completions を使用するため、このシリーズでは 404 が返されます。OpenAI の Images API をサポートしているツールを使用するか、本ドキュメントのコードサンプルを使って直接呼び出してください。1 リクエストあたり何枚の画像を生成できますか?
1 リクエストあたり何枚の画像を生成できますか?
n の値に関わらず、受け取りおよび課金は 1 枚分となります。さらに必要な場合は、並行リクエストを送信してください。編集エンドポイントでは n が機能します。n=2 は 2 枚の画像を返し、2 枚分として課金されます。usage の token 数で課金を照合できますか?
usage の token 数で課金を照合できますか?
usage.prompt_tokens は常に「1000 × 画像数」であり、output_tokens は常に 0 です。これらはプレースホルダーです。このシリーズは画像ごとに課金され、APIYI コンソールの請求明細が正式なものとなります。モデレーションはどれくらい厳格ですか? ブロックされるとどうなりますか?
モデレーションはどれくらい厳格ですか? ブロックされるとどうなりますか?
400 content_safety_violation が返され、メッセージに具体的な理由が示されます。prompt レベルのブロックは通常 5〜8 秒以内に返されます。生成後に適用される一部のブロックは、通常の画像生成と同程度の時間がかかります。同じ prompt で再試行しても解決しないため、表現を書き換えてください。ストリーミングはサポートされていますか?
ストリーミングはサポートされていますか?
503 no available channels が返されますか?
503 no available channels が返されますか?
MAI-Image-2.6 または MAI-Image-2.6-Flash である必要があり、mai-image-2.6-flash を指定すると 503 が返されます。関連ドキュメント
- MAI-Image 2.6 Text-to-Image API - Playground付きAPIリファレンス
- MAI-Image 2.6 画像編集API - 参照画像編集と2画像合成
- 画像APIの要点とベストプラクティス - タイムアウト、切断、圧縮
- チャージボーナスプロモーション