Skip to main content

概述

MAI-Image 2.6 是微软 AI(Microsoft AI)自研的图像生成模型,2026-09-04 发布、在 Microsoft Foundry 公开预览。发布时在 Arena 榜单上文生图与图片编辑均排第 2,在 Artificial Analysis 榜单上图片编辑排第 1(数据截至 2026-09-04,来源:微软官方公告)。 API易 通过微软官方渠道(官转)提供两个型号,共用同一套接口与参数:
  • MAI-Image-2.6:旗舰版,追求画质与精度
  • MAI-Image-2.6-Flash:快速版,官方称出图速度是 GPT-Image-2-Medium 的 2.8 倍,适合高吞吐的生产场景
核心亮点:中文文字渲染出色(招牌、对联、手写体都能逐字正确),编辑保真度高(只改指定部分、其余像素级保留),width + height 自定义任意画幅(最高 1536×1536 面积),按次固定计费、不区分尺寸。1024×1024 出图 Flash 约 17 秒、2.6 约 30 秒。
📌 上手前必看的三条
  1. 只支持两个端点:/v1/images/generations(文生图,JSON)和 /v1/images/edits(编辑,multipart/form-data)。不支持 /v1/chat/completions 和 /v1/responses,发过去会返回 404。
  2. 不要传 response_format、seed、negative_prompt——这三个参数会直接返回 400。返回值固定是 data[0].b64_json(PNG)。
  3. 尺寸用 width + height,不用 size。文生图接口传 size 会被静默忽略,结果恒为 1024×1024。
图片 API 全部为同步调用:没有异步任务 ID,客户端断开连接结果即丢失、但请求仍会计费。请为本模型设置足够大的 timeout,详见 图片 API 调用须知与最佳实践。

文生图 API

输入文本提示词生成图片,带交互式 Playground 在线调试。

图片编辑 API

上传参考图 + 编辑指令生成新图,支持双图融合,带 Playground。

让 AI Agent 帮你接入

在用 Codex / Claude Code / Cursor 开发的话,把下面这段提示词复制给它。它会先抓本页的纯文本版(任意文档页地址后加 .md),再按你项目的技术栈写代码——超时、三个会 400 的参数、width/height 取代 size、编辑接口只认文件上传这几个高频坑已经写死在要求里。

让编程 Agent 接入或排查 MAI-Image 2.6 的文生图与图片编辑。复制后直接粘贴给 Codex、Claude Code、Cursor 等。

为什么选 API易 的 MAI-Image 2.6

微软官方渠道

官转接入,模型与微软 Foundry 上的同名模型一致。走标准 /v1/images/generations 与 /v1/images/edits,响应结构与 OpenAI Images API 一致。

按次计费 · 成本可预测

原厂按 token 计费、图越大越贵;API易 按张固定价、不区分尺寸,从 768×768 到 1536×1536 同价,预算可精确到张。

全球零门槛接入

无需 Azure 账号与海外服务器,国内机房、家宽网络、海外节点均可直连 api.apiyi.com,一个 Key 调所有模型。

模型生态齐全

图像侧还有 GPT-Image-2、Nano Banana 2、Seedream、FLUX 可按场景组合。

核心特性

中文文字渲染

中文招牌、竖排对联、黑板手写都能逐字正确,适合海报、电商主图、文创物料

高保真编辑

「把茶壶改成钴蓝釉」只改茶壶,尺寸标注、其它物件像素级保留

自定义画幅

width + height 任意组合,最长边可到 3072(如 3072×768 横幅),面积上限 1536×1536

双档速度

1024×1024 出图 Flash 约 17 秒、2.6 约 30 秒;10 并发下延迟稳定

实测效果

中文文字渲染(MAI-Image-2.6-Flash,提示词要求招牌写「API易 欢迎」):招牌、灯笼、竖排对联、黑板手写全部是可读的中文。
MAI-Image-2.6-Flash 中文文字渲染示例:古风茶馆招牌写着 API易 欢迎
参考图编辑(MAI-Image-2.6-Flash,指令「把茶壶改成深钴蓝釉,其余完全不变」):左为原图,右为结果。只有茶壶变色,尺寸标注与其它物件保持不变。
MAI-Image-2.6-Flash 编辑示例:茶壶从米白改为钴蓝,其余不变

模型定价

模型价格可能调整;上表仅供参考,具体以顶部导航「模型价格」栏目为准:模型价格。
计费说明
  • 按张计费、不区分尺寸:768×768 与 1536×1536 同价;提示词长短不影响价格。
  • 编辑与文生图同价:单图编辑、双图融合都是一次一张的价格;编辑接口传 n=2 按 2 张计费。
  • 被拦截或参数错误的请求(400)不出图。
  • 响应体里的 usage 不能用来核账:prompt_tokens 恒为 1000 × 张数,是占位值,真实扣费以控制台账单为准。
  • 可叠加 充值加赠活动。

分组与令牌

本系列在 Default 默认分组,新建令牌即可直接调用,无需申请。
令牌「计费模式」:选 按量优先 或 按次计费 都能正常调用本系列。推荐 按量优先,同一把令牌还能兼容站内其它按 token 计费的模型。速率:单个 Key 建议控制在 50 RPM 以内;有大批量出图需求请提前联系客服报备。

技术规格

端点一览

❌ 不支持对话端点/v1/chat/completions 与 /v1/responses 对本系列返回 404 Requested path is not found。Cherry Studio、LobeChat 这类对话式客户端会对模型列表里的所有模型发 chat 请求,请不要在这类客户端里选用 MAI-Image,改用支持 Images API 的工具或自己写代码调用。
✅ 编辑接口只认 multipart 文件上传发送 JSON(image 填 URL、data URI 或裸 base64)到 /v1/images/edits 会返回 400:
请用 -F "[email protected]" 直接上传本地文件,不需要图床。完整示例见 图片编辑 API。
主域名 https://api.apiyi.com,备用域名 https://b.apiyi.com。

关键参数详解

width 与 height(输出尺寸)

常用画幅参考(都在面积上限内):
size 的行为在两个端点上不一样:文生图接口传 size 会被静默忽略(恒出 1024×1024),编辑接口传 size 却会生效。为了避免混淆,两个端点都统一用 width + height。

n(张数)

  • 文生图:n 无效,传 2、4、10 都只返回 1 张(也只收 1 张的钱)。需要多张请并发多次请求。
  • 编辑:n 有效,n=2 返回 2 张、按 2 张计费。

最佳实践

1

按场景选型号

批量出图、对延迟敏感 → MAI-Image-2.6-Flash;海报主视觉、复杂构图、对画质要求高 → MAI-Image-2.6。两者参数完全一致,切换只改模型名。
2

中文文字写进引号

要在图里出现的中文,用引号括起来并说明位置,例如:招牌上写「API易 欢迎」。模型对引号内文字的还原度很高。
3

编辑时明确写「其余保持不变」

编辑指令写成「把茶壶改成钴蓝釉,其余部分完全保持不变」,能最大限度保留原图。
4

改画幅会重新构图

编辑时传与原图不同比例的 width / height,模型会重新排布画面而不是裁切或留白。只想改局部时不要传尺寸,输出会按原图比例贴合到 16 的倍数(如 1344×756 输入 → 1360×768 输出)。
5

多张图就并发请求

文生图一次只出一张,要 4 张就并发 4 个请求。实测 10 并发延迟与单发基本一致。

错误码与重试

客户端建议:上表中的 4xx / 500 都是确定性错误,重试没有意义,应直接告警。只有网络层超时和 429 值得重试,建议指数退避、最多 3 次——但注意超时断开的请求仍会计费,先加大 timeout。

常见问题

本系列只返回 b64_json 一种格式,不接受 response_format 参数,传 "b64_json" 也一样报 400 Invalid parameters: response_format。从 gpt-image / DALL·E 迁移过来的代码往往显式写了这个参数,删掉即可,返回值依然在 data[0].b64_json。seed 和 negative_prompt 同理。
文生图接口不认 size,会静默忽略并按默认 1024×1024 出图。请改成 "width": 1536, "height": 1024。编辑接口的 size 反而能生效,但为了两边写法统一,建议都用 width + height。
不能。 编辑接口只接受 multipart/form-data 文件上传,image 填 URL、data URI 或 base64 字符串都会返回 400。如果你手上只有图片 URL,先在服务端下载成文件再上传:
第二张图的字段名要写成 image2:
OpenAI SDK 的 client.images.edit(image=[f1, f2]) 会把两张图都发成 image[] 字段,本系列不接受同名多文件,会返回 400。单图编辑用 SDK 没问题。
不支持,带 mask 字段会返回 400。局部修改请直接在提示词里描述修改范围,例如「只把茶壶改成蓝色,其余部分完全保持不变」——实测本模型对这类约束的遵循度很高。
不建议。 这类对话客户端走的是 /v1/chat/completions,本系列在该端点返回 404。请使用支持 OpenAI Images API 的工具,或按本文档的代码示例直接调用。
文生图接口固定 1 张,n 传多少都只返回 1 张、只收 1 张的钱。需要多张请并发多次请求。编辑接口的 n 有效,n=2 返回 2 张、按 2 张计费。
不能。 响应体的 usage.prompt_tokens 恒为 1000 × 张数、output_tokens 恒为 0,是占位值。本系列按张固定计费,真实扣费请以 API易 控制台的账单记录为准。
本系列走微软官方的内容安全策略,审核较严格:真人名人、暴力血腥、知名 IP 角色(如迪士尼)、裸露内容都会被拦截。被拦时返回 400 content_safety_violation,错误信息里带具体原因。提示词类拦截通常 5–8 秒内返回;少数情况是出图后才拦截,耗时接近正常出图。重试同样的提示词无效,请调整表述。
不支持。 请按普通同步请求调用,等待完整响应返回。
最常见的原因是模型名大小写写错。模型名必须严格写成 MAI-Image-2.6 或 MAI-Image-2.6-Flash,写成 mai-image-2.6-flash 会返回 503。

相关文档