Create video
最近更新:2026年9月7日
用 minimax/minimax-h3 出片,走 MiniMax 原生形状,现有 MiniMax 客户端直接可用。
使用 minimax/minimax-h3 生成视频,请求体为 MiniMax 原生形状:提示词与素材放在同一个
content[] 数组里。现有 MiniMax 客户端只需将 base_url 指向本站即可使用。
https://gateway.amux.ai/v2/video_generation鉴权
headerAuthorizationstring必填Bearer <你的 Amux 密钥> 站内 API Key。
请求
application/jsonmodelstring必填固定为 minimax/minimax-h3。也可以用不带厂商前缀的 minimax-h3,大小写不敏感。
contentarray<object>必填提示词与输入素材放在同一个数组里。
⚠️ 必须含一条非空的 text 项——这个模型的提示词是必填的。
›contentarray<object>
type"text" | "image_url" | "video_url" | "audio_url"必填这一项是什么种类。⚠️ 它不是用途——用途在 role 上。
textstringtype: text 时的提示词,最长 7000 字符。指代素材时用自然语言描述,这个模型没有 [Image 1] 那类标记。
role"first_frame" | "last_frame" | "reference_image" | "reference_video" | "reference_audio"这件素材的用途。这个模型收的是:first_frame / last_frame / reference_image / reference_video / reference_audio。
image_urlobject⚠️ 地址嵌在与 type 同名的对象里,不是平铺的 url。仅接受公开可访问的 https 地址。
›image_urlobject
urlstring公开可访问的 https 地址。该地址由模型拉取,本站不会访问它。
resolution"768P" | "2K"默认 "768P"输出分辨率档。这是计价维度,单价按所选档位的每秒价算。这个模型只有 768P / 2K。⚠️ 上游把它定为必填,未提供时我们按 768P 送出并在任务的 notes 里说明。
durationinteger默认 4出片秒数,4–15 的整数。这个模型没有智能时长(-1)。⚠️ 上游把它定为必填,未提供时我们按 5 送出并记 note。
ratio"adaptive" | "21:9" | "16:9" | "4:3" | "1:1" | "3:4" | "9:16"画面比例。⚠️ 纯文生时不能用 adaptive(没有素材可跟),未提供则按 16:9 送出并记 note。
aigc_watermarkboolean默认 false是否在输出视频上添加 AIGC 水印。
callback_urlstring任务到终态时回调这个地址。它就是站内的 webhook_url——我们只是改了个名字,投递内容与统一入口那条完全一致。必须是可投递的公网 https 地址。
响应
200response任务已受理。响应体里只有 task_id。
400response参数不合法、缺少提示词,或这个模型不收的素材角色。
402response可用余额不足以覆盖预扣上界。
503response当前没有可用的供应商能服务这个模型。
三处最容易踩的
1. 提示词必填
content 里必须有一条非空的 text 项,哪怕你已经给了首帧图。
这一点和站内其它视频模型不同——它们允许「只给图、不给提示词」。
2. type 不是用途,地址也不是平铺的
{
"content": [
{ "type": "text", "text": "让画面里的人走向镜头" },
{ "type": "image_url", "role": "first_frame", "image_url": { "url": "https://…/a.png" } }
]
}| 字段 | 是什么 |
|---|---|
type | 媒体种类:text / image_url / video_url / audio_url |
role | 用途:首帧、尾帧各 1,参考图 9 张,参考视频与参考音频各 3 段 |
<type>.url | 地址,嵌在一个与 type 同名的对象里 |
role 不能省略——省了返回 400 而不是被猜成首帧。猜错的代价是你要等十几分钟、
付完钱才看到出来的不是想要的东西。
3. 纯文生必须带一个具体 ratio
adaptive 的意思是「跟着输入素材的比例走」,而纯文生没有素材可跟。
未提供时我们按 16:9 送出,并在任务的 notes 里说明这件事;
显式传了 adaptive 而又不给素材时返回 400。
取值域
| 参数 | 这个模型 |
|---|---|
resolution | 768P / 2K |
duration | 4–15 的整数 |
ratio | adaptive(需素材)/ 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 |
| 素材 | 首帧、尾帧各 1,参考图 9 张,参考视频与参考音频各 3 段 |
超出范围返回 400 并给出可接受的取值,不会被静默替换。
⚠️ resolution 与 duration 在上游是必填的。未提供时我们按 768P / 5
送出,并在任务的 notes 里说明——「参数均为可选」这条承诺由我们兑现,
不是上游给的。
素材规格
这几条由上游判,我们不代为校验(我们比上游严一分就是一分误杀):
| 限制 | |
|---|---|
| 图片 | ≤ 30 MB,边长 [256, 5760] px,宽高比 [0.4, 2.5] |
| 视频 | ≤ 50 MB,≤ 3 段,单段 2–15 秒且合计 ≤ 15 秒,帧率 [23.976, 60] |
| 音频 | ≤ 15 MB,≤ 3 段,单段 2–15 秒且合计 ≤ 15 秒 |
计费
这个模型为输入素材收费:参考图按张、参考视频按其输入时长(费率随出片分辨率档走);参考音频免费。
出片按秒 × 分辨率档。示例里那个 cost(0.36)是 768P × 4 秒 + 1 张参考图 的价。
提交时按上界预扣:15 秒出片,带参考视频时再加 15 秒输入,参考图按实际张数。完成后按上游返回的实际用量结算并释放差额。
回调
callback_url 就是站内的 webhook_url,只是名字不同——任务到终态时
回调它,投递内容与统一入口那条完全一致。
任务 ID 是我们的 ID
返回的 task_id 是 Amux 的任务 ID,不是上游的。拿它去
统一取回口 或
MiniMax 形状的取回口,
两条查的是同一个任务。
curl https://gateway.amux.ai/v2/video_generation \
-H "Authorization: Bearer $AMUX_API_KEY" \
-d '{
"model": "minimax/minimax-h3",
"content": [
{
"type": "text",
"text": "A ginger cat running through fresh snow, slow motion"
}
],
"resolution": "768P",
"duration": 4,
"ratio": "16:9"
}'{
"task_id": "<string>"
}