概述
MAI-Image 2.6 是微软 AI(Microsoft AI)自研的图像生成模型,2026-09-04 发布、在 Microsoft Foundry 公开预览。发布时在 Arena 榜单上文生图与图片编辑均排第 2,在 Artificial Analysis 榜单上图片编辑排第 1(数据截至 2026-09-04,来源:微软官方公告)。 API易 通过微软官方渠道(官转)提供两个型号,共用同一套接口与参数:MAI-Image-2.6:旗舰版,追求画质与精度MAI-Image-2.6-Flash:快速版,官方称出图速度是 GPT-Image-2-Medium 的 2.8 倍,适合高吞吐的生产场景
核心亮点:中文文字渲染出色(招牌、对联、手写体都能逐字正确),编辑保真度高(只改指定部分、其余像素级保留),
width + height 自定义任意画幅(最高 1536×1536 面积),按次固定计费、不区分尺寸。1024×1024 出图 Flash 约 17 秒、2.6 约 30 秒。图片 API 全部为同步调用:没有异步任务 ID,客户端断开连接结果即丢失、但请求仍会计费。请为本模型设置足够大的 timeout,详见 图片 API 调用须知与最佳实践。
文生图 API
输入文本提示词生成图片,带交互式 Playground 在线调试。
图片编辑 API
上传参考图 + 编辑指令生成新图,支持双图融合,带 Playground。
让 AI Agent 帮你接入
在用 Codex / Claude Code / Cursor 开发的话,把下面这段提示词复制给它。它会先抓本页的纯文本版(任意文档页地址后加
.md),再按你项目的技术栈写代码——超时、三个会 400 的参数、width/height 取代 size、编辑接口只认文件上传这几个高频坑已经写死在要求里。让编程 Agent 接入或排查 MAI-Image 2.6 的文生图与图片编辑。复制后直接粘贴给 Codex、Claude Code、Cursor 等。
这段提示词替你挡掉了什么
这段提示词替你挡掉了什么
为什么选 API易 的 MAI-Image 2.6
微软官方渠道
官转接入,模型与微软 Foundry 上的同名模型一致。走标准
/v1/images/generations 与 /v1/images/edits,响应结构与 OpenAI Images API 一致。按次计费 · 成本可预测
原厂按 token 计费、图越大越贵;API易 按张固定价、不区分尺寸,从 768×768 到 1536×1536 同价,预算可精确到张。
全球零门槛接入
无需 Azure 账号与海外服务器,国内机房、家宽网络、海外节点均可直连
api.apiyi.com,一个 Key 调所有模型。模型生态齐全
图像侧还有 GPT-Image-2、Nano Banana 2、Seedream、FLUX 可按场景组合。
核心特性
中文文字渲染
中文招牌、竖排对联、黑板手写都能逐字正确,适合海报、电商主图、文创物料
高保真编辑
「把茶壶改成钴蓝釉」只改茶壶,尺寸标注、其它物件像素级保留
自定义画幅
width + height 任意组合,最长边可到 3072(如 3072×768 横幅),面积上限 1536×1536双档速度
1024×1024 出图 Flash 约 17 秒、2.6 约 30 秒;10 并发下延迟稳定
实测效果
中文文字渲染(MAI-Image-2.6-Flash,提示词要求招牌写「API易 欢迎」):招牌、灯笼、竖排对联、黑板手写全部是可读的中文。

MAI-Image-2.6-Flash,指令「把茶壶改成深钴蓝釉,其余完全不变」):左为原图,右为结果。只有茶壶变色,尺寸标注与其它物件保持不变。

模型定价
模型价格可能调整;上表仅供参考,具体以顶部导航「模型价格」栏目为准:模型价格。
计费说明
- 按张计费、不区分尺寸:768×768 与 1536×1536 同价;提示词长短不影响价格。
- 编辑与文生图同价:单图编辑、双图融合都是一次一张的价格;编辑接口传
n=2按 2 张计费。 - 被拦截或参数错误的请求(400)不出图。
- 响应体里的
usage不能用来核账:prompt_tokens恒为1000 × 张数,是占位值,真实扣费以控制台账单为准。 - 可叠加 充值加赠活动。
分组与令牌
本系列在Default 默认分组,新建令牌即可直接调用,无需申请。
令牌「计费模式」:选
按量优先 或 按次计费 都能正常调用本系列。推荐 按量优先,同一把令牌还能兼容站内其它按 token 计费的模型。速率:单个 Key 建议控制在 50 RPM 以内;有大批量出图需求请提前联系客服报备。技术规格
端点一览
关键参数详解
width 与 height(输出尺寸)
常用画幅参考(都在面积上限内):
n(张数)
- 文生图:
n无效,传 2、4、10 都只返回 1 张(也只收 1 张的钱)。需要多张请并发多次请求。 - 编辑:
n有效,n=2返回 2 张、按 2 张计费。
最佳实践
1
按场景选型号
批量出图、对延迟敏感 →
MAI-Image-2.6-Flash;海报主视觉、复杂构图、对画质要求高 → MAI-Image-2.6。两者参数完全一致,切换只改模型名。2
中文文字写进引号
要在图里出现的中文,用引号括起来并说明位置,例如:招牌上写「API易 欢迎」。模型对引号内文字的还原度很高。
3
编辑时明确写「其余保持不变」
编辑指令写成「把茶壶改成钴蓝釉,其余部分完全保持不变」,能最大限度保留原图。
4
改画幅会重新构图
编辑时传与原图不同比例的
width / height,模型会重新排布画面而不是裁切或留白。只想改局部时不要传尺寸,输出会按原图比例贴合到 16 的倍数(如 1344×756 输入 → 1360×768 输出)。5
多张图就并发请求
文生图一次只出一张,要 4 张就并发 4 个请求。实测 10 并发延迟与单发基本一致。
错误码与重试
客户端建议:上表中的 4xx / 500 都是确定性错误,重试没有意义,应直接告警。只有网络层超时和
429 值得重试,建议指数退避、最多 3 次——但注意超时断开的请求仍会计费,先加大 timeout。常见问题
为什么传了 response_format 就报 400?
为什么传了 response_format 就报 400?
本系列只返回
b64_json 一种格式,不接受 response_format 参数,传 "b64_json" 也一样报 400 Invalid parameters: response_format。从 gpt-image / DALL·E 迁移过来的代码往往显式写了这个参数,删掉即可,返回值依然在 data[0].b64_json。seed 和 negative_prompt 同理。传了 size: 1536x1024 为什么出来还是方图?
传了 size: 1536x1024 为什么出来还是方图?
文生图接口不认
size,会静默忽略并按默认 1024×1024 出图。请改成 "width": 1536, "height": 1024。编辑接口的 size 反而能生效,但为了两边写法统一,建议都用 width + height。能用图片 URL 做编辑吗?
能用图片 URL 做编辑吗?
不能。 编辑接口只接受
multipart/form-data 文件上传,image 填 URL、data URI 或 base64 字符串都会返回 400。如果你手上只有图片 URL,先在服务端下载成文件再上传:怎么传两张参考图?OpenAI SDK 为什么不行?
怎么传两张参考图?OpenAI SDK 为什么不行?
第二张图的字段名要写成 OpenAI SDK 的
image2:client.images.edit(image=[f1, f2]) 会把两张图都发成 image[] 字段,本系列不接受同名多文件,会返回 400。单图编辑用 SDK 没问题。支持 mask 局部重绘吗?
支持 mask 局部重绘吗?
不支持,带
mask 字段会返回 400。局部修改请直接在提示词里描述修改范围,例如「只把茶壶改成蓝色,其余部分完全保持不变」——实测本模型对这类约束的遵循度很高。能在 Cherry Studio / LobeChat 里用吗?
能在 Cherry Studio / LobeChat 里用吗?
不建议。 这类对话客户端走的是
/v1/chat/completions,本系列在该端点返回 404。请使用支持 OpenAI Images API 的工具,或按本文档的代码示例直接调用。一次能出几张?
一次能出几张?
文生图接口固定 1 张,
n 传多少都只返回 1 张、只收 1 张的钱。需要多张请并发多次请求。编辑接口的 n 有效,n=2 返回 2 张、按 2 张计费。usage 里的 token 数能用来核对账单吗?
usage 里的 token 数能用来核对账单吗?
不能。 响应体的
usage.prompt_tokens 恒为 1000 × 张数、output_tokens 恒为 0,是占位值。本系列按张固定计费,真实扣费请以 API易 控制台的账单记录为准。内容审核严吗?被拦了是什么样?
内容审核严吗?被拦了是什么样?
本系列走微软官方的内容安全策略,审核较严格:真人名人、暴力血腥、知名 IP 角色(如迪士尼)、裸露内容都会被拦截。被拦时返回
400 content_safety_violation,错误信息里带具体原因。提示词类拦截通常 5–8 秒内返回;少数情况是出图后才拦截,耗时接近正常出图。重试同样的提示词无效,请调整表述。支持流式输出吗?
支持流式输出吗?
不支持。 请按普通同步请求调用,等待完整响应返回。
调用返回 503 no available channels?
调用返回 503 no available channels?
最常见的原因是模型名大小写写错。模型名必须严格写成
MAI-Image-2.6 或 MAI-Image-2.6-Flash,写成 mai-image-2.6-flash 会返回 503。相关文档
- MAI-Image 2.6 文生图 API - 带 Playground 的接口参考
- MAI-Image 2.6 图片编辑 API - 参考图编辑与双图融合
- 图片 API 调用须知与最佳实践 - 超时、断连、压缩通用建议
- 充值加赠活动