DeepSeek: DeepSeek V4 Flash 0731deepseek/deepseek-v4-flash
减 15%对话DeepSeek V4 Flash 是 DeepSeek 的效率优化混合专家模型,总参数为 284B,激活参数为 13B,支持 1M 代币上下文窗口。它专为快速推理和高吞吐量工作负载而设计,同时保持强大的推理和编码性能。
- 输入类型:
- 输出类型:
- 输入:
- $0.22/百万
- 输出:
- $0.66/百万
- 上下文长度:
- 1M
- 最大输出:
- 393K
2 个供应商
由 DeepSeek 提供的模型
DeepSeek V4 Flash 是 DeepSeek 的效率优化混合专家模型,总参数为 284B,激活参数为 13B,支持 1M 代币上下文窗口。它专为快速推理和高吞吐量工作负载而设计,同时保持强大的推理和编码性能。
DeepSeek V4 Flash Vision Exp 是 DeepSeek 的 DeepSeek V4 Flash 0731 的实验性视觉版本,增加了图像理解,同时在文本功能(包括代理、推理和世界知识)上匹配基本模型。它是一个稀疏专家混合模型,共有 284B 个活动参数,其中有 13B 个。
DeepSeek V4 Pro是DeepSeek推出的大规模Mixture-of-Experts模型,总参数1.6T,激活参数49B,支持1M-token上下文窗口。它专为高级推理、编码和长期代理工作流程而设计,在知识、数学和软件工程基准方面具有强大的性能。