Create video generation
最近更新:2026年9月6日
按 MiniMax 原生形状提交视频生成任务。提示词与素材在同一个 content 数组里。
按 MiniMax 视频生成 v2 的形状提交一个视频任务。已有 MiniMax 代码时,
把 base_url 指向本站即可,请求体与响应形状和你现在发的一致。
https://gateway.amux.ai/v2/video_generation鉴权
headerAuthorizationstring必填Bearer <你的 Amux 密钥> 控制台创建的 Amux 密钥。忘了可以回控制台的密钥页再看一次。
请求
application/jsonmodelstring必填站内模型 ID。这条端点上今天有两个:
| 模型 | 分辨率 | 时长 | 素材 |
|---|---|---|---|
minimax/minimax-h3 | 768P 2K | 4–15 秒 | 首尾帧 + 全能参考 |
minimax/minimax-h3-max | 480P 768P | 5–15 秒 | 只有首尾帧 |
contentarray<object>必填提示词与输入素材放在同一个数组里。
⚠️ 必须含一条非空的 text 项——这个模型的提示词是必填的,
只给首帧图不构成一次合法请求。
›contentarray<object>
type"text" | "image_url" | "video_url" | "audio_url"必填这一项是什么种类。
⚠️ 它不是用途——用途在 role 上。两者是分开的两个字段。
textstringtype: text 时的提示词,最长 7000 字符。
指代输入素材时用自然语言描述(「人物参考视频 1 的动作」),
这个模型没有 [Image 1] 那类标记写法。
urlstring素材地址。仅接受公开可访问的 https 地址,
该地址由模型拉取,本站不会访问它。
role"first_frame" | "last_frame" | "reference_image" | "reference_video" | "reference_audio"这件素材的用途。件数上限:首帧、尾帧各 1,参考图 9 张,
参考视频与参考音频各 3 段。
首尾帧与参考素材可以同时给——这是这个模型和百炼形状
最容易搞混的一处。
resolution"768P" | "2K"默认 "768P"输出分辨率档位。该字段是计价维度,出片与输入视频的单价
都按所选档位计算。
durationinteger默认 5出片秒数,4–15 的整数。这个模型没有智能时长(-1)。
ratio"adaptive" | "21:9" | "16:9" | "4:3" | "1:1" | "3:4" | "9:16"默认 "adaptive"画面比例。adaptive 表示随输入素材自适应。
aigc_watermarkboolean默认 false是否在输出视频上添加 AIGC 水印。
callback_urlstring任务到终态时回调这个地址。它就是站内的 webhook_url——我们只是按官方的
字段名收下它,投递内容与统一入口那条完全一致({event, sent_at, task} 信封 +
Amux-Signature 签名 + 退避重试)。
只收 https,且不能指向内网。 地址在提交这一刻就校验。
响应
200response任务已受理。响应体里只有 task_id——拿它去 GET /v1/tasks/{id}
(或下面那条别名)轮询。
400response参数不合法、缺少提示词,或素材件数超出上限。
402response可用余额不足以覆盖预扣上界。预扣按 15 秒出片计,
带参考视频时再加 15 秒的输入上界。
503response当前没有可用的供应商能服务这个模型。
这条端点上有哪些模型
| 模型 | 分辨率 | 时长 | 能力 | 输入素材计费 |
|---|---|---|---|---|
minimax/minimax-h3 | 768P 2K | 4–15 秒 | 文生 / 图生 / 首尾帧 / 全能参考 | 是 |
minimax/minimax-h3-max | 480P 768P | 5–15 秒 | 文生 / 图生(首尾帧) | 否 |
每个模型的精确取值域、计费与踩坑点见它自己的页: MiniMax H3 · MiniMax H3 Max。
⚠️ 两个模型的差别不只是档位。 h3-max 不收任何参考素材
(官方原话:「不支持多模态参考」),传了会在提交时被拒;它的时长下界是
5 不是 4——从 H3 切过来时最容易撞上的就是这个。
和百炼形状最容易搞混的三处
从 POST /api/v1/services/aigc/video-generation/video-synthesis
迁过来时,下面三条各会让你收到一次 400 或者一次「不是我要的片子」:
1. 提示词是必填的
百炼那条允许「只给首帧图、不给提示词」——这条不允许。content 里必须有
一条非空的 text 项,哪怕你已经给了首帧。
2. type 不是用途
这是两边差别最大的一处:
| 百炼形状 | 这条 | |
|---|---|---|
| 素材放在哪 | input.media[] | content[],和提示词同级 |
| 用途写在哪 | type 字段 | role 字段 |
type 是什么 | 用途 | 媒体种类(image_url / video_url / audio_url) |
{
"content": [
{ "type": "text", "text": "让画面里的人走向镜头" },
{ "type": "image_url", "role": "first_frame", "url": "https://…/a.png" },
{ "type": "video_url", "role": "reference_video", "url": "https://…/b.mp4" }
]
}role 不能省略。 省了会返回 400 而不是被猜成首帧——猜错的代价是你要等十几
分钟、付完钱才看到出来的不是想要的东西。
3. 首尾帧与参考素材可以同时给
百炼那条明确规定两者互斥,这条没有这个限制——全能参考本来就是要组合着用的。 逐角色的件数上限:
| 角色 | 上限 |
|---|---|
first_frame / last_frame | 各 1 |
reference_image | 9 |
reference_video | 3 段(单段 2–15 秒,合计不超过 15 秒) |
reference_audio | 3 段 |
指代输入素材用自然语言
这个模型没有 [Image 1] 那类标记写法。想让它参考某一件素材时,
在提示词里直接说:「人物的动作参考第一段视频」。
计费:这个模型的输入素材要花钱
站内其它视频模型只按出片秒数计费,这个不是:
| 计费项 | h3 | h3-max |
|---|---|---|
| 出片 | 按秒 × 出片分辨率档 | 同左 |
| 参考视频 | 按输入素材的时长 × 出片分辨率档 | 不收(它也不收这类素材) |
| 参考图 | 按张 | 不收(官方:暂不对输入素材计费) |
| 参考音频 | 免费 | 免费 |
注意参考视频那一行的分辨率取的是出片的档位,不是素材自己的分辨率。
提交时按上界预扣:15 秒出片,带参考视频时再加 15 秒输入,参考图按实际张数。
完成后按上游返回的实际用量结算并释放差额。想少冻一点,就少传素材——
出片那 15 秒的上界与你填的 duration 无关。
任务 ID 是我们的 ID
返回的 task_id 是 Amux 的任务 ID。拿它去
GET /v1/tasks/{id} 或者
MiniMax 形状的别名,
两条查的是同一个任务。
curl https://gateway.amux.ai/v2/video_generation \
-H "Authorization: Bearer $AMUX_API_KEY" \
-d '{
"model": "minimax/minimax-h3",
"content": [
{
"type": "text",
"text": "A ginger cat running through fresh snow, slow motion"
}
],
"resolution": "768P",
"duration": 5
}'{
"task_id": "<string>"
}