Create video
最近更新:2026年9月6日
用 alibaba/happyhorse-1.0 出片,走阿里云百炼原生形状,DashScope 客户端直接可用。
使用 alibaba/happyhorse-1.0 生成视频,请求体为阿里云百炼原生形状
(嵌套的 input.* / parameters.*)。现有 DashScope 客户端只需将 base_url
指向本站即可使用。
https://gateway.amux.ai/api/v1/services/aigc/video-generation/video-synthesis鉴权
headerAuthorizationstring必填Bearer <你的 Amux 密钥> 站内 API Key。
请求
application/jsonmodelstring必填站内模型 ID,或三个能力别名之一
(happyhorse-1.0-t2v / -i2v / -r2v)。
用聚合 ID 时由素材决定打哪一个;用能力别名时以别名为准,
素材不符返回 400。
inputobject必填prompt 与 media 至少提供一个,也可以同时提供。
首帧图生成视频可以不带提示词;不要为满足字段而提交空字符串,那会影响生成质量。
›inputobject
promptstring生成内容的描述。上限 5,000 个非中文字符或 2,500 个中文字符,
超出部分由上游截断而非报错。
参考图生视频时,用 [Image 1] [Image 2](带方括号)
指代 media 数组中对应顺序的参考图,并指明图中的具体对象。
这是上游文档规定的写法,写成别的形式不会报错,但那个引用不会生效。
mediaarray<object>输入素材。只接受公开可访问的 https 地址,
阿里云百炼支持的 oss:// 与图片 base64 在此不受理。
两类素材互斥:首帧图与参考图属于两个不同的能力,
不能同时出现。
›mediaarray<object>
type"first_frame" | "reference_image"必填这件素材的用途,同时决定打上游哪个模型:
| 角色 | 数量 | 打到 | 格式与限制 |
|---|---|---|---|
first_frame | 恰好 1 件 | -i2v | JPEG/JPG/PNG/WEBP,≤20MB,单边 ≥300px,宽高比 1:2.5–2.5:1 |
reference_image | 1–9 件 | -r2v | 同上 |
两者不能混用。混用返回 400,并说明哪一件不合。
首帧图生视频的画面比例由图片决定,此时 ratio 不生效。
urlstring必填公开可访问的 https 地址。该地址由模型拉取,本站不会访问它。
parametersobject生成参数,均为可选。未提供的字段沿用该模型自身的默认值,
本站不代为设置。
⚠️ 该模型没有 audio 与 prompt_extend——输出恒有声音,
提示词不做改写。传了这两个字段会被摘掉,并在任务的
result_meta.notes 里说明。
›parametersobject
resolution"720P" | "1080P"默认 "1080P"输出分辨率档位。该字段是计价维度,单价按所选档位的每秒价计算。
⚠️ 1.0 没有 480P 那一档(1.1 有)。传 480P 返回 400。
ratio"16:9" | "9:16" | "4:3" | "3:4" | "4:5" | "5:4" | "1:1" | "9:21" | "21:9"默认 "16:9"画面比例。没有 adaptive 这一档(那是万相的);
首帧图生视频时比例由图片决定,此字段不生效。
durationinteger默认 5出片秒数,3–15。
⚠️ 该模型没有 -1(智能时长)那一档,那是万相的。
传 -1 或超出区间的值返回 400,并给出可接受的范围。
seedinteger随机种子,用于复现结果。未提供时随机生成。
watermarkboolean默认 true是否在输出视频上添加水印。该模型默认为 true
(万相默认为 false),不想要水印需显式传 false。
webhook_urlstring任务到终态时往这里 POST 一份结果,形状与 POST /v1/tasks 那条的回调完全一致
({event, sent_at, task} 信封 + Amux-Signature 签名 + 退避重试)。
⚠️ 这个字段是本站加的,官方没有。 百炼的异步任务确实有回调,但它是在
阿里云控制台用 EventBridge 配事件规则——请求里传不了地址。不加的话,
走这条端点的调用方只能轮询,而同一个任务走站内统一入口就能收到推送。
只收 https,且不能指向内网——我们是从服务端发过去的。地址在提交这一刻
就校验,写错了当场报错,而不是等任务跑完才发现回调从来没来。
响应
200response任务已建立。状态码是 200 而非 202,与阿里云百炼官方接口一致。
400response参数或素材不合法。常见三类:素材与能力别名不符、duration 超出 3–15、
比例不在该模型的九档之内。错误信息里会给出可接受的取值。
402response余额不足以覆盖本次预扣。
503response没有可用的供应链路,或本站在途任务已达上限。稍后重试。
一个站内 ID,上游三个模型
上游把 HappyHorse 按能力拆成了三个模型,本站聚合成一个 ID。 打哪一个由你传的素材决定:
| 你传了什么 | 打到上游的 | 说明 |
|---|---|---|
只有 prompt | happyhorse-1.0-t2v | 纯文生视频 |
一件 first_frame | happyhorse-1.0-i2v | 首帧图生视频 |
1–9 件 reference_image | happyhorse-1.0-r2v | 参考图生视频 |
也可以用能力别名点名,官方那三个 ID 本站都收,与聚合 ID 完全等价:
可用的 model 取值 | 含义 |
|---|---|
alibaba/happyhorse-1.0 · happyhorse-1.0 | 聚合 ID,由素材决定能力 |
happyhorse-1.0-t2v | 点名纯文生视频 |
happyhorse-1.0-i2v | 点名首帧图生视频 |
happyhorse-1.0-r2v | 点名参考图生视频 |
点名之后素材必须与之相符,否则返回 400,而不是被悄悄改成别的能力:
「你写着 -i2v、我们打了 r2v」在账单上看不出来,而片子已经出了。
三个能力价格完全相同,选哪个只影响生成方式。日志与取回结果里的 model
回显的是你自己写的那个名字。
提交返回任务 ID
该端点为异步接口:提交后立即返回任务 ID,视频在后台生成,结果通过轮询获取。
Prefer: wait 在此几乎必然降级为未完成——其上限为 90 秒,
而本端点的常态耗时是分钟级。
返回状态码为 200 而非 202,与阿里云百炼官方接口一致。
task_id 是 Amux 的任务 ID,不是上游 ID。取回可使用
百炼形状端点或
站内统一端点,
两者返回同一个任务的两种渲染,后者附带 usage 与 cost。
输入素材
media 数组中的每一件素材都带有 type 字段标明其用途,同时决定打上游哪个模型。
逐个角色的数量上限、格式与体积限制见上方参数面板的 media[].type。
首帧图与参考图互斥:它们属于两个不同的能力,同时提供返回 400。
素材地址只接受公开可访问的 https URL。 阿里云百炼支持的 oss:// 地址与
图片 base64 在本站两条端点上均不受理,非 https 地址与指向私有网段的地址返回 400。
三个需要注意的参数
prompt 并非必填。 必填条件是「prompt 与 media 至少提供一个」,
首帧图生成视频可以不带提示词;不要为满足字段而提交空字符串,那会影响生成质量。
参考图要在提示词里指代。 用 [Image 1] [Image 2](带方括号)
指代 media 中对应顺序的参考图,并指明图中的具体对象。这是上游文档规定的写法;
写成别的形式不会报错,但那个引用不会生效。
resolution 是计价维度。 只有 720P 与 1080P 两档(1.1 才有 480P)。传 480P 返回 400。
与万相的差异
同一条协议上的两个系列,取值域逐项不同。从万相迁过来时这几处要改:
| 万相 3.0 | HappyHorse 1.0 | |
|---|---|---|
| 时长 | 2–30,或 -1(智能时长) | 3–15,没有 -1 |
| 比例 | 含 adaptive(随素材) | 没有 adaptive,多出 4:5 5:4 9:21 21:9 |
audio | 可开关 | 没有这个参数,恒有声 |
prompt_extend | 有 | 没有 |
watermark 默认 | false | true |
| 提示词上限 | 20,000 字符 | 5,000 非中文 / 2,500 中文 |
| 指代参考素材 | 「图1」「视频1」 | [Image 1](带方括号) |
| 输出帧率 | 30fps | 24fps |
传了它没有的参数(audio / prompt_extend)会被摘掉,
并在任务的 result_meta.notes 里说明——不会因此报错,但也不会静默。
取值超出范围(比如 duration: 30)返回 400 并给出可接受的范围,
不会被静默替换成默认值。
计费
视频不产生 token。计费方式为该分辨率档的每秒单价 × 实际出片秒数, 输入素材不单独计价。三种能力同价。
提交时按上界预扣,任务完成后按实际用量结算并退还差额。 失败与超时不计费,预扣已释放。逐档单价见模型目录中该模型的详情页。
错误
type 取值与重试语义见错误与重试。
curl https://gateway.amux.ai/api/v1/services/aigc/video-generation/video-synthesis \
-H "Authorization: Bearer $AMUX_API_KEY" \
-d '{
"model": "alibaba/happyhorse-1.0",
"input": {
"prompt": "A ginger cat running through fresh snow, slow motion"
},
"parameters": {
"resolution": "1080P",
"duration": 5
}
}'{
"output": {
"task_id": "<string>",
"task_status": "PENDING",
"video_url": "<string>",
"code": "<string>",
"message": "<string>"
},
"request_id": "<string>"
}