Amux
全部模型

Alibaba: Wan3.0-Video

正常

Alibaba: Wan3.0-Video 是一款多功能参考视频生成模型,支持文本转视频、图像转视频(首帧/首尾帧)以及基于参考的视频生成。它能够生成长达 30 秒、30fps 的视频。

厂商:
Alibaba
输入类型:
输出类型:
上下文长度:
20K
发布时间:
2026-08-24
vision

供应商

同一个模型,不同供应商。自动路由会在同一质量层级内挑选价格最优且健康的那个。

供应商
减 20%alibaba-cloud
480P$0.05$0.04/秒720P$0.1$0.08/秒1080P$0.2$0.16/秒
20K

可用率

24 小时

Amux 网关实际发出的请求在各供应商上的成功率。分母不含客户端错误——请求写错了不算供应商的账。

活动

24 小时

该模型随时间变化的 token 用量与成本,按实际处理请求的供应商拆分。

按实际处理请求的供应商拆分。金额与账单同一口径:上游报错的调用不向用户收费,因此不计入。

相关模型

更多来自 Alibaba 的模型

Alibaba: Wan3.0-Video-Prime20K 上下文1 个供应商Alibaba: Wan3.0-Video-Prime 是 Wan3.0 视频生成模型的高速版本。它具备与标准 Wan3.0-Video 模型同等的强大能力,支持四种模态的综合参考输入,可生成长达 30 秒的视频,并在提供沉浸式视听体验的同时,显著提升了端到端的生成速度。
Alibaba: HappyHorse 1.11 个供应商Alibaba: HappyHorse 1.1是阿里巴巴的视频生成模型。它根据文本提示、单个起始图像或一组参考图像生成短视频,输出分辨率高达 1080p,持续时间为 3 到 15 秒。它适用于创意内容、社交媒体剪辑和图像驱动的动画,并在先前版本的基础上进行了改进,具有更强的提示依从性、更流畅的运动以及跨帧的更一致的角色。
Alibaba: HappyHorse 1.01 个供应商Alibaba: HappyHorse 1.0 被描述为一款开源的最先进 AI 视频生成器,具有原生音视频联合生成功能——这意味着 alibaba: HappyHorse 1.0 视频模型可以在单次前向传递中同时生成视频帧和相应的音轨(对话、环境音、拟音),而不是先生成静音视频再进行后期配音。 根据社区整理的架构说明,该模型围绕一个 150 亿参数的统一自注意力 Transformer 构建,可在单个标记序列内处理文本、图像、视频和音频标记。据报道,它在构建时没有采用专用的交叉注意力分支,也没有单独的音频模块。结合 DMD-2 蒸馏技术,据称其蒸馏版本在 NVIDIA H100 上仅需 8 个去噪步骤,且无需无分类器引导(classifier-free guidance),即可在大约 38 秒内生成 1080p 视频。