Skip to main content

概要

MAI-Image 2.6は、Microsoft AIが独自開発した画像生成モデルであり、2026-09-04にリリースされ、Microsoft Foundryにてパブリックプレビューとして利用可能です。リリース時、Arenaのテキストからの画像生成および画像編集の両部門で第2位、Artificial Analysisの画像編集部門で第1位を獲得しました(2026-09-04時点、Microsoftの発表による)。 APIYIでは、Microsoftの公式チャネルを通じて2つのバリアントを提供しています。両バリアントとも同じエンドポイントとパラメーターを共有します。
  • MAI-Image-2.6: 品質と精度を重視して調整されたフラグシップモデル
  • MAI-Image-2.6-Flash: 高速バリアント。MicrosoftによるとGPT-Image-2-Mediumより2.8倍高速に生成でき、高スループットな本番ワークロードに適しています
主な特徴: 優れた中国語テキストレンダリング(店舗の看板、対聯、手書き文字が文字単位で正確に出力されます)、忠実度の高い編集(指定された箇所のみが変更され、残りはピクセル単位で完全に同一のまま維持されます)、width + height による自由なキャンバス指定(最大1536×1536の領域まで)、そしてサイズに関係のない画像1枚あたりの定額課金です。1024×1024の画像生成にかかる時間は、Flashで約17秒、2.6で約30秒です。
📌 開始前に知っておくべき3つのポイント
  1. サポートされているエンドポイントは2つのみです: /v1/images/generations(テキストからの画像生成、JSON)および /v1/images/edits(編集、multipart/form-data)。/v1/chat/completions と /v1/responses はサポートされておらず、404を返します。
  2. response_format、seed、negative_prompt は送信しないでください。3つとも直ちに400を返します。レスポンスは常に data[0].b64_json(PNG)です。
  3. サイズは size ではなく width + height で設定してください。テキストからの画像生成エンドポイントでは、size は警告なしに無視され、常に1024×1024が出力されます。
すべての画像APIは同期処理です。非同期タスクIDは存在しません。クライアントが切断された場合、生成結果は失われますが、リクエストは課金されます。このモデルには十分なタイムアウト時間を設定してください。画像APIの要点とベストプラクティスをご参照ください。

テキストからの画像生成API

テキストpromptから画像を生成します。インタラクティブなPlaygroundが付属しています。

画像編集API

参照画像と指示をアップロードします。2枚の画像合成にも対応しています。Playgroundが付属しています。

AIエージェントに統合を任せる

Codex / Claude Code / Cursor を使って開発している場合は、以下の prompt をそこにコピーしてください。エージェントはまずこのページのプレーンテキスト版を取得し(任意のドキュメントURLの末尾に .md を追加)、お使いの技術スタックに合わせたコードを作成します。タイムアウト、400 を返す3つのパラメータ、size の代わりに width/height を使用すること、ファイルアップロード限定の編集など、よくある落とし穴が明記されています。

コーディングエージェントに MAI-Image 2.6 のテキストからの画像生成および画像編集を統合またはデバッグさせます。Codex、Claude Code、Cursor などにコピー&ペーストしてください。

APIYI で MAI-Image 2.6 を利用する理由

Microsoft 公式チャネル

Microsoft の公式チャネルを通じて提供されます。モデルは Microsoft Foundry 上の同名モデルと同一です。標準の /v1/images/generations および /v1/images/edits エンドポイントに対応しており、OpenAI Images API と同様の形式でレスポンスが返されます。

画像単位の料金設定

プロバイダーは tokens 単位で課金するため、画像サイズが大きくなるほどコストが高くなります。APIYI ではサイズに関わらず画像1枚あたりの一律定額を採用しており、768×768 でも 1536×1536 でも同額なため、画像単位で予算を管理できます。

どこからでもアクセス可能

Azure アカウントや海外サーバーは不要です。 データセンター、自宅ネットワーク、海外ノードのどこからでも直接 api.apiyi.com にアクセスでき、1つのキーですべてのモデルを利用可能です。

充実したモデルラインナップ

さまざまなユースケースに合わせて、GPT-Image-2、Nano Banana 2、Seedream、FLUX と組み合わせて利用できます。

主な機能

中国語テキストのレンダリング

中国語の店舗看板、対聯、黒板の手書き文字などが正確な文字で出力されます。ポスター、商品画像、グッズの制作に適しています。

高精度な編集

「ティーポットをコバルトブルーにする」といった指示でもティーポットのみが変更され、寸法ラベルやその他のオブジェクトはピクセル単位で同一のまま維持されます。

カスタムキャンバス

任意のwidth + heightの組み合わせに対応し、長辺は最大3072(例:3072×768のバナー)、総面積の上限は1536×1536です。

2つの速度ティア

1024×1024の場合、Flashで約17秒、2.6で約30秒かかります。10件の同時実行数でもレイテンシは安定して維持されます。

サンプル結果

中国語テキストのレンダリング(MAI-Image-2.6-Flash、APIYIへの来訪者を歓迎する中国語の看板を指定したprompt):看板、提灯、対聯、黒板のすべてにおいて判読可能な中国語が表示されています。
MAI-Image-2.6-Flashの中国語テキストレンダリング:中国語の歓迎看板がある伝統的な茶屋
参照画像編集(MAI-Image-2.6-Flash、指示:「ティーポットを濃いコバルトブルーの釉薬に変更し、その他はすべて同じに保つ」):左が元画像、右が結果です。ティーポットの色のみが変更され、寸法ラベルやその他のオブジェクトは変更されていません。
MAI-Image-2.6-Flashの編集例:ティーポットの色がクリーム色からコバルトブルーに変更され、その他はすべて未変更

料金

モデルの価格は変更される場合があります。上記の表は参考情報であり、上部ナビゲーションのモデル価格タブが正式な情報となります:モデル価格。
課金に関する注意事項
  • サイズに関わらず画像1枚あたり:768×768と1536×1536は同じ料金であり、promptの長さは価格に影響しません。
  • 編集はテキストからの画像生成と同額:1枚の画像編集および2枚の画像合成はそれぞれ画像1枚として課金されます。編集エンドポイントでのn=2は画像2枚分として課金されます。
  • 400エラーで失敗したリクエスト(モデレーションまたは無効なパラメータ):画像は生成されません。
  • レスポンスのusageフィールドと照合しないでください:prompt_tokensは常に「画像数 × 1000」のプレースホルダーです。コンソールの課金情報が正式なものとなります。
  • チャージボーナスプロモーションと併用可能です。

グループと Tokens

このシリーズは**Default グループ**に属しています。新規作成されたすべての token で呼び出すことができ、申請は不要です。
token 課金モード: このシリーズでは Pay-as-you-go Priority と Per-request の両方をご利用いただけます。プラットフォーム上の token 課金モデルでも同じ token を利用できるよう、Pay-as-you-go Priority を推奨します。レート: 単一キーは 50 RPM 未満に抑えてください。大規模なバッチワークロードの場合は、事前にサポートまでお問い合わせください。

技術仕様

エンドポイント

❌ チャットエンドポイントはサポートされていませんこのシリーズでは、/v1/chat/completions および /v1/responses は 404 Requested path is not found を返します。Cherry Studio や LobeChat などのチャットクライアントはリスト内のすべてのモデルにチャットリクエストを送信するため、これらのクライアントでは MAI-Image を選択しないでください。Images API をサポートするツールを使用するか、独自のコードから呼び出してください。
✅ 編集エンドポイントはマルチパートファイルアップロードのみを受け付けますJSON(URL、data URI、または生の base64 形式の image を含む)を /v1/images/edits に送信すると、400 が返されます:
-F "[email protected]" を使用してローカルファイルを直接アップロードしてください。画像ホスティングは不要です。 完全な例については 画像編集 API を参照してください。
プライマリドメインは https://api.apiyi.com、バックアップドメインは https://b.apiyi.com です。

主要パラメータ

width および height(出力サイズ)

一般的なキャンバスサイズ(すべて面積上限内):
size は2つのエンドポイントで挙動が異なります: テキストから画像生成では暗黙的に無視され(常に1024×1024)、編集エンドポイントでは有効になります。混乱を避けるため、両方のエンドポイントで width + height を使用してください。

n(画像枚数)

  • テキストから画像生成: n は効果がありません。2、4、または10を指定して送信しても1枚の画像のみが返されます(課金も1枚分)。さらに必要な場合は並列リクエストを送信してください。
  • 編集: n は機能します。n=2 は2枚の画像を返し、2枚分として課金されます。

ベストプラクティス

1

ユースケースに応じてバリアントを選択する

バッチ生成やレイテンシを重視する処理 → MAI-Image-2.6-Flash。ヒーローポスター、複雑な構図、または高い品質基準が求められる場合 → MAI-Image-2.6。パラメータは同一であるため、切り替えはモデル名を変更するだけです。
2

描画したいテキストを引用符で囲む

画像内に表示させたいテキストは引用符で囲み、どこに配置するかを指定します(例: 「Grand Opening」と書かれた看板)。モデルは引用符内のテキストを極めて忠実に再現します。
3

編集時は「その他はすべてそのまま変更しない」と指定する

元の画像を可能な限り維持するために、「Make the teapot cobalt blue, keep everything else exactly the same(ティーポットをコバルトブルーにし、その他はすべて完全に元のままにしてください)」のように指示を記述します。
4

キャンバスを変更すると画像が再構成される

元の画像と異なるアスペクト比の width / height を渡すと、モデルはクロップ(切り抜き)やパディングを行うのではなく、シーンを再レイアウトします。部分的な編集の場合はサイズ指定を省略すると、出力は16の倍数にスナップされた元の比率に従います(例: 1344×756の入力 → 1360×768の出力)。
5

複数の画像が必要な場合は並行リクエストを送信する

テキストからの画像生成(Text-to-image)では1回の呼び出しにつき1枚の画像が返されるため、4枚の画像が必要な場合は4つの並行リクエストを送信してください。テストでは、同時実行数が10件の場合でも単一リクエストと同等のレイテンシでした。

エラーコードとリトライ

クライアント向けのアドバイス: 上記の4xx / 500エラーは確定的なものであるため、リトライしても意味がありません。代わりにアラート通知を行ってください。リトライする価値があるのはネットワークタイムアウトと429のみであり、指数バックオフを用いて最大3回までに留めてください。クライアント側のタイムアウトにより破棄されたリクエストも課金対象となる点に注意し、まずはタイムアウト値を長めに設定してください。

FAQ

このシリーズは b64_json のみを返し、response_format パラメーターを受け付けません。"b64_json" であっても 400 Invalid parameters: response_format が返されます。gpt-image や DALL·E から移行したコードでは明示的に設定されていることがよくあります。削除してください。画像は引き続き data[0].b64_json に含まれます。seed および negative_prompt についても同様です。
テキストからの画像生成エンドポイントは size を読み取りません。暗黙的に無視され、デフォルトの 1024×1024 でレンダリングされます。代わりに "width": 1536, "height": 1024 を使用してください。編集エンドポイントでは size は機能しますが、一貫性を保つため両方で width + height を使用してください。
できません。 編集エンドポイントは multipart/form-data ファイルのアップロードのみを受け付けます。URL、data URI、または base64 文字列を image として渡すと 400 が返されます。URL しかない場合は、まずサーバー側でダウンロードしてからアップロードしてください。
2 枚目の画像のフィールド名を image2 にしてください。
OpenAI SDK の client.images.edit(image=[f1, f2]) は、両方のファイルを image[] として送信します。このシリーズは重複したファイルフィールドを受け付けず、400 を返します。SDK を使用した単一画像の編集は問題なく動作します。
サポートされていません。 mask フィールドを指定すると 400 が返されます。部分的な変更を行うには、prompt 内で領域を指定してください(例: 「Only make the teapot blue, keep everything else exactly the same」など)。弊社のテストでは、モデルはこのような制約に忠実に従います。
推奨されません。 これらのチャットクライアントは /v1/chat/completions を使用するため、このシリーズでは 404 が返されます。OpenAI の Images API をサポートしているツールを使用するか、本ドキュメントのコードサンプルを使って直接呼び出してください。
テキストからの画像生成では常に 1 枚返されます。送信する n の値に関わらず、受け取りおよび課金は 1 枚分となります。さらに必要な場合は、並行リクエストを送信してください。編集エンドポイントでは n が機能します。n=2 は 2 枚の画像を返し、2 枚分として課金されます。
できません。 usage.prompt_tokens は常に「1000 × 画像数」であり、output_tokens は常に 0 です。これらはプレースホルダーです。このシリーズは画像ごとに課金され、APIYI コンソールの請求明細が正式なものとなります。
このシリーズは Microsoft の公式コンテンツセーフティポリシーを採用しており、かなり厳格です。実在の有名人、流血・残虐表現、著名な IP キャラクター(ディズニーなど)、ヌードはブロックされます。ブロックされると 400 content_safety_violation が返され、メッセージに具体的な理由が示されます。prompt レベルのブロックは通常 5〜8 秒以内に返されます。生成後に適用される一部のブロックは、通常の画像生成と同程度の時間がかかります。同じ prompt で再試行しても解決しないため、表現を書き換えてください。
サポートされていません。 通常の同期リクエストとして呼び出し、完全なレスポンスをお待ちください。
最も一般的な原因は、モデル名の大文字・小文字の誤りです。モデル名は正確に MAI-Image-2.6 または MAI-Image-2.6-Flash である必要があり、mai-image-2.6-flash を指定すると 503 が返されます。

関連ドキュメント