MiniMax-M3 是 MiniMax 的多模态基础模型。它支持文本、图像和视频输入以及文本输出、1M 令牌上下文窗口,适合长期代理工作、编码和工具使用。它基于 MiniMax Sparse Attention (MSA) 构建,用 KV 块选择取代完全注意力,以减少长上下文中每个令牌的计算量 — 大约是上一代 1M 令牌成本的 1/20,预填充和解码速度显着加快,同时保持大多数任务的质量。
- 输入类型:
- 输出类型:
- 输入:
- $0.6$0.3/百万
- 输出:
- $2.4$1.2/百万
- 上下文长度:
- 1M
- 最大输出:
- 512K