Amux
全部模型

Alibaba Cloud

由 Alibaba Cloud 提供的模型

模型 · 6

  • Alibaba: HappyHorse 1.0
    减 20%对话

    Alibaba: HappyHorse 1.0 被描述为一款开源的最先进 AI 视频生成器,具有原生音视频联合生成功能——这意味着 alibaba: HappyHorse 1.0 视频模型可以在单次前向传递中同时生成视频帧和相应的音轨(对话、环境音、拟音),而不是先生成静音视频再进行后期配音。 根据社区整理的架构说明,该模型围绕一个 150 亿参数的统一自注意力 Transformer 构建,可在单个标记序列内处理文本、图像、视频和音频标记。据报道,它在构建时没有采用专用的交叉注意力分支,也没有单独的音频模块。结合 DMD-2 蒸馏技术,据称其蒸馏版本在 NVIDIA H100 上仅需 8 个去噪步骤,且无需无分类器引导(classifier-free guidance),即可在大约 38 秒内生成 1080p 视频。

    输入类型:
    输出类型:
    输入:
    输出:
    $0.112-0.192/秒
    上下文长度:
    最大输出:
    1 个供应商
  • Alibaba: HappyHorse 1.1
    减 30%对话

    Alibaba: HappyHorse 1.1是阿里巴巴的视频生成模型。它根据文本提示、单个起始图像或一组参考图像生成短视频,输出分辨率高达 1080p,持续时间为 3 到 15 秒。它适用于创意内容、社交媒体剪辑和图像驱动的动画,并在先前版本的基础上进行了改进,具有更强的提示依从性、更流畅的运动以及跨帧的更一致的角色。

    输入类型:
    输出类型:
    输入:
    输出:
    $0.049-0.126/秒
    上下文长度:
    最大输出:
    1 个供应商
  • Alibaba: Wan3.0-Video
    减 20%对话

    Alibaba: Wan3.0-Video 是一款多功能参考视频生成模型,支持文本转视频、图像转视频(首帧/首尾帧)以及基于参考的视频生成。它能够生成长达 30 秒、30fps 的视频。

    输入类型:
    输出类型:
    输入:
    输出:
    $0.04-0.16/秒
    上下文长度:
    20K
    最大输出:
    1 个供应商
  • Alibaba: Wan3.0-Video-Prime
    减 15%对话

    Alibaba: Wan3.0-Video-Prime 是 Wan3.0 视频生成模型的高速版本。它具备与标准 Wan3.0-Video 模型同等的强大能力,支持四种模态的综合参考输入,可生成长达 30 秒的视频,并在提供沉浸式视听体验的同时,显著提升了端到端的生成速度。

    输入类型:
    输出类型:
    输入:
    输出:
    $0.0578-0.238/秒
    上下文长度:
    20K
    最大输出:
    1 个供应商
  • DeepSeek: DeepSeek V4 Flash 0731
    减 15%对话

    DeepSeek V4 Flash 是 DeepSeek 的效率优化混合专家模型,总参数为 284B,激活参数为 13B,支持 1M 代币上下文窗口。它专为快速推理和高吞吐量工作负载而设计,同时保持强大的推理和编码性能。

    输入类型:
    输出类型:
    输入:
    $0.22/百万
    输出:
    $0.66/百万
    上下文长度:
    1M
    最大输出:
    393K
    2 个供应商
  • DeepSeek: DeepSeek V4 Pro 0813
    减 15%对话

    DeepSeek V4 Pro是DeepSeek推出的大规模Mixture-of-Experts模型,总参数1.6T,激活参数49B,支持1M-token上下文窗口。它专为高级推理、编码和长期代理工作流程而设计,在知识、数学和软件工程基准方面具有强大的性能。

    输入类型:
    输出类型:
    输入:
    $0.66/百万
    输出:
    $1.98/百万
    上下文长度:
    1M
    最大输出:
    393K
    2 个供应商