Amux

Create video generation

最近更新:2026年9月6日

按 MiniMax 原生形状提交视频生成任务。提示词与素材在同一个 content 数组里。

按 MiniMax 视频生成 v2 的形状提交一个视频任务。已有 MiniMax 代码时, 把 base_url 指向本站即可,请求体与响应形状和你现在发的一致。

POSThttps://gateway.amux.ai/v2/video_generation

鉴权

header
Authorizationstring必填

Bearer <你的 Amux 密钥> 控制台创建的 Amux 密钥。忘了可以回控制台的密钥页再看一次。

请求

application/json
modelstring必填

站内模型 ID。这条端点上今天有两个:

模型分辨率时长素材
minimax/minimax-h3768P 2K4–15 秒首尾帧 + 全能参考
minimax/minimax-h3-max480P 768P5–15 秒只有首尾帧
contentarray<object>必填

提示词与输入素材放在同一个数组里。

⚠️ 必须含一条非空的 text——这个模型的提示词是必填的,

只给首帧图不构成一次合法请求。

contentarray<object>
type"text" | "image_url" | "video_url" | "audio_url"必填

这一项是什么种类

⚠️ 它不是用途——用途在 role 上。两者是分开的两个字段。

textstring

type: text 时的提示词,最长 7000 字符。

指代输入素材时用自然语言描述(「人物参考视频 1 的动作」),

这个模型没有 [Image 1] 那类标记写法。

urlstring

素材地址。仅接受公开可访问的 https 地址

该地址由模型拉取,本站不会访问它。

role"first_frame" | "last_frame" | "reference_image" | "reference_video" | "reference_audio"

这件素材的用途。件数上限:首帧、尾帧各 1,参考图 9 张,

参考视频与参考音频各 3 段。

首尾帧与参考素材可以同时给——这是这个模型和百炼形状

最容易搞混的一处。

resolution"768P" | "2K"默认 "768P"

输出分辨率档位。该字段是计价维度,出片与输入视频的单价

都按所选档位计算。

durationinteger默认 5

出片秒数,4–15 的整数。这个模型没有智能时长(-1)。

ratio"adaptive" | "21:9" | "16:9" | "4:3" | "1:1" | "3:4" | "9:16"默认 "adaptive"

画面比例。adaptive 表示随输入素材自适应。

aigc_watermarkboolean默认 false

是否在输出视频上添加 AIGC 水印。

callback_urlstring

任务到终态时回调这个地址。它就是站内的 webhook_url——我们只是按官方的

字段名收下它,投递内容与统一入口那条完全一致({event, sent_at, task} 信封 +

Amux-Signature 签名 + 退避重试)。

只收 https,且不能指向内网。 地址在提交这一刻就校验。

响应

200response

任务已受理。响应体里只有 task_id——拿它去 GET /v1/tasks/{id}

(或下面那条别名)轮询。

400response

参数不合法、缺少提示词,或素材件数超出上限。

402response

可用余额不足以覆盖预扣上界。预扣按 15 秒出片计,

带参考视频时再加 15 秒的输入上界。

503response

当前没有可用的供应商能服务这个模型。

这条端点上有哪些模型

模型分辨率时长能力输入素材计费
minimax/minimax-h3768P 2K4–15 秒文生 / 图生 / 首尾帧 / 全能参考
minimax/minimax-h3-max480P 768P5–15 秒文生 / 图生(首尾帧)

每个模型的精确取值域、计费与踩坑点见它自己的页: MiniMax H3 · MiniMax H3 Max

⚠️ 两个模型的差别不只是档位。 h3-max 不收任何参考素材 (官方原话:「不支持多模态参考」),传了会在提交时被拒;它的时长下界是 5 不是 4——从 H3 切过来时最容易撞上的就是这个。

和百炼形状最容易搞混的三处

POST /api/v1/services/aigc/video-generation/video-synthesis 迁过来时,下面三条各会让你收到一次 400 或者一次「不是我要的片子」:

1. 提示词是必填的

百炼那条允许「只给首帧图、不给提示词」——这条不允许content 里必须有 一条非空的 text 项,哪怕你已经给了首帧。

2. type 不是用途

这是两边差别最大的一处:

百炼形状这条
素材放在哪input.media[]content[],和提示词同级
用途写在哪type 字段role 字段
type 是什么用途媒体种类image_url / video_url / audio_url
{
  "content": [
    { "type": "text", "text": "让画面里的人走向镜头" },
    { "type": "image_url", "role": "first_frame", "url": "https://…/a.png" },
    { "type": "video_url", "role": "reference_video", "url": "https://…/b.mp4" }
  ]
}

role 不能省略。 省了会返回 400 而不是被猜成首帧——猜错的代价是你要等十几 分钟、付完钱才看到出来的不是想要的东西。

3. 首尾帧与参考素材可以同时给

百炼那条明确规定两者互斥,这条没有这个限制——全能参考本来就是要组合着用的。 逐角色的件数上限:

角色上限
first_frame / last_frame各 1
reference_image9
reference_video3 段(单段 2–15 秒,合计不超过 15 秒)
reference_audio3 段

指代输入素材用自然语言

这个模型没有 [Image 1] 那类标记写法。想让它参考某一件素材时, 在提示词里直接说:「人物的动作参考第一段视频」。

计费:这个模型的输入素材要花钱

站内其它视频模型只按出片秒数计费,这个不是

计费项h3h3-max
出片按秒 × 出片分辨率档同左
参考视频输入素材的时长 × 出片分辨率档不收(它也不收这类素材)
参考图按张不收(官方:暂不对输入素材计费)
参考音频免费免费

注意参考视频那一行的分辨率取的是出片的档位,不是素材自己的分辨率。

提交时按上界预扣:15 秒出片,带参考视频时再加 15 秒输入,参考图按实际张数。 完成后按上游返回的实际用量结算并释放差额。想少冻一点,就少传素材—— 出片那 15 秒的上界与你填的 duration 无关。

任务 ID 是我们的 ID

返回的 task_id 是 Amux 的任务 ID。拿它去 GET /v1/tasks/{id} 或者 MiniMax 形状的别名, 两条查的是同一个任务。

cURL
curl https://gateway.amux.ai/v2/video_generation \
  -H "Authorization: Bearer $AMUX_API_KEY" \
  -d '{
    "model": "minimax/minimax-h3",
    "content": [
      {
        "type": "text",
        "text": "A ginger cat running through fresh snow, slow motion"
      }
    ],
    "resolution": "768P",
    "duration": 5
  }'
{
  "task_id": "<string>"
}