Skip to main content

概述

MiniMax H3(海螺 3.0)是 MiniMax 于 2026-07-31 (UTC+8) 发布的全模态视频生成模型:一个模型同时理解文本、图片、视频和音频,直接输出带立体声音轨的视频。API易 通过开源权重自部署通道提供 MiniMax-H3,分辨率 768P,时长 4–15 秒,按秒计费。
核心亮点:同一个端点支持文生视频、首帧 / 尾帧 / 首尾帧生视频、最多 9 张参考图 + 3 段参考视频 + 3 段参考音频的混合参考生成;每条视频自带配乐与音效;$0.03/秒(原厂官方 API 为 $0.08/秒),10 秒视频 $0.30,失败任务自动退款。

视频生成 API 参考

创建任务 + 按 task_id 查询,含 Python / cURL / Node.js 示例与在线调试

充值加赠活动

充值加赠叠加后,实际单价更低

让 AI Agent 帮你接入

在用 Codex / Claude Code / Cursor 开发的话,把下面这段提示词复制给它。它会先抓本页的纯文本版(任意文档页地址后加 .md),再按你项目的技术栈写代码——路径要带 /hailuo、结果包在 task 里、duration 必须是 4 到 15 的整数这几个高频坑已经写死在要求里。

让编程 Agent 接入或排查 MiniMax-H3 视频生成。复制后直接粘贴给 Codex、Claude Code、Cursor 等。

为什么选 API易 的 MiniMax-H3

完整能力开放

文生、首尾帧、参考图 / 视频 / 音频混合生成全部可用,参考素材上限与官方一致(9 图 + 3 视频 + 3 音频)

按秒计费,失败退款

$0.03/秒,只为成功的视频付费;任务失败自动全额退款,提交报错不扣费

充值加赠可叠加

叠加 充值加赠活动 后实际成本更低

全球零门槛接入

api.apiyi.com 直连,一个 API Key 即可调用,无需海外账号

视频模型生态齐全

同一个 Key 还能调 Seedance 2.0 / 2.5、Wan2.7、VEO 3.1 等视频模型

专业服务

接入问题可联系客服,企业客户可获得接入陪跑

核心特性

原生立体声

每条视频自带配乐与音效,由提示词和参考音频驱动,无需后期配音

7 种画幅

21:9 到 9:16 六档固定比例,另有 adaptive 跟随参考图比例

4–15 秒任意整数时长

按实际秒数计费,短视频不浪费

长提示词

单条提示词最长 7000 字符,适合分镜式详细描述

首尾帧控制

只给首帧、只给尾帧、或首尾帧同时给,控制起止画面

多参考图

最多 9 张参考图,提示词里用 <Picture 1> 等标签指定角色与物体

参考视频动作迁移

最多 3 段参考视频,复刻运镜与动作节奏

音频驱动

最多 3 段参考音频,画面随音乐节奏或人声生成

模型定价

本通道部署的是 MiniMax 开源的 H3 权重,不是原厂官方 API 的转发,因此采用独立定价:
本通道为开源权重自部署,定价独立于原厂官方 API,且可能调整;上表仅供参考,具体以顶部导航「模型价格」栏目为准:模型价格。原厂价格来源:platform.minimax.io/docs/guides/pricing-paygo(2026-09-29 获取)。
计费说明:
  • 按请求的 duration 秒数计费,提交受理时预扣
  • 参考素材不额外收费:参考图(最多 9 张)、参考视频、参考音频都不影响价格,只按时长计费
  • 任务失败(素材下载失败、格式不支持、执行失败等)自动全额退款
  • 提交阶段返回 4xx / 5xx 的请求不扣费;查询和下载不收费
  • 充值加赠政策见 充值加赠活动,叠加后实际成本更低

分组介绍

MiniMax-H3 在 default 默认分组即可调用,svip 分组同样可用,无需切换专属分组。令牌计费模式推荐 按量优先(Pay-as-you-go Priority)。如果调用时报「当前分组没有可用渠道」,说明令牌分组不含本模型,或 model 拼写有误(大小写敏感)。

技术规格

MiniMax H3 官方模型支持 2K,但本通道只开放 768P,传 2K 会被拒绝。

端点一览

主域名 https://api.apiyi.com,备用域名 https://vip.apiyi.com,路径相同。注意路径以 /hailuo 开头,不是 /v1。

生成方式详解

系统根据 content[] 里有什么素材自动判断生成方式:

提示词里怎么引用参考素材

同类素材按在 content[] 中出现的顺序各自编号:第 1、2 张参考图是 <Picture 1>、<Picture 2>;第 1 段参考视频是 <Video 1>;第 1 段参考音频是 <Audio 1>。例如:
  • 首帧 / 尾帧不能与任何参考素材混用
  • 只有一张图片时可以省略 role(按首帧处理);两张及以上必须显式写 role
  • 多段参考视频的累计时长不能超过 15 秒,否则任务会失败(自动退款);单段超过 15 秒则只取片头 15 秒

最佳实践

1

先用 4–5 秒试效果

按秒计费,先用短时长确认构图和风格,再出 10–15 秒的正式版本
2

文生视频选固定比例

横屏 16:9、竖屏 9:16、宽银幕 21:9;带首帧图时用 adaptive 保持原图比例
3

素材先放到稳定的公网存储

用自己的 OSS / CDN 直链,避免防盗链、临时签名过期导致素材下载失败
4

提示词写清运镜和声音

描述主体、动作、镜头运动、光线,以及想要的音乐和音效,模型会一并生成
5

轮询间隔 10 秒

生成通常 2–4 分钟,客户端整体超时给 15 分钟
6

自己做幂等

保存「业务 ID 到 task_id」的映射;提交超时时先查已有任务,不要直接重新提交
7

拿到地址立即转存

task.content.url 用 GET 下载后存到自己的存储再分发

错误码与重试

客户端建议:提交请求超时设 60 秒(高峰期提交本身可能要 10 秒以上);只对 HTTP 500 和网络错误做退避重试;所有执行阶段失败都已自动退款,重新提交会产生新的计费。

常见问题

路径少了 /hailuo 前缀。正确路径是 /hailuo/v2/video_generation 和 /hailuo/v2/query/video_generation/{task_id}。
本通道只支持 768P。MiniMax 官方模型支持 2K,但本通道未开放。
不能,duration 取值为 4–15 的整数。
每条视频都自带立体声音轨,目前没有关闭参数。不需要声音时可在后期去掉音轨。
目前不能。带相同 Idempotency-Key 重复提交仍会创建新任务并分别计费。请在业务层自行记录已提交的任务。
不会。任务进入 failed 后自动全额退款;提交阶段直接报错的请求也不扣费。
不可以,所有素材都必须是公网 HTTPS 链接。可先上传到自己的对象存储再传链接。
跟随输入图片的宽高比,例如方图输出 768×768、16:9 图输出 1344×768。纯文本和纯音频请求不能用 adaptive。
单段超过 15 秒会自动只取片头 15 秒;但多段参考视频累计超过 15 秒时任务会失败(自动退款)。
实测中位数约 3 分钟,通常 2–4 分钟,10–15 秒的视频会更久一些。
地址目前未见短时过期,但不承诺长期有效,请拿到后尽快下载转存。检查地址时请用 GET,HEAD 请求会返回 403。
先确认请求体符合规范(只有一个文本项、没有多余字段、素材是 https 链接);确认无误的话多为瞬时过载,退避几秒后重试即可,报错的请求不扣费。

相关文档