模型对比
把几个模型并排放在一起比价格、上下文、性能、端点与功能。一列是一个模型在一家供应商上的报价——同一个模型放两列,比的就是两家。
概览
开发者DeepSeek
开发者DeepSeek
上下文长度1M token
上下文长度1M token
最大输出384K token
最大输出384K token
推理支持
推理支持
输入类型
输入类型
输出类型
输出类型
价格
输入Off-Peak$0.15$0.135/百万 tokensPeak$0.3$0.27/百万 tokens
输入Peak$0.3/百万 tokensOff-Peak$0.15/百万 tokens
输出Off-Peak$0.6$0.54/百万 tokensPeak$1.2$1.08/百万 tokens
输出Peak$1.2/百万 tokensOff-Peak$0.6/百万 tokens
读取Off-Peak$0.015$0.0135/百万 tokensPeak$0.03$0.027/百万 tokens
读取Peak$0.006/百万 tokensOff-Peak$0.003/百万 tokens
性能
平均首字延迟1.05 s
平均首字延迟0.32 s
平均吐字速率181.6 tok/s
平均吐字速率92.9 tok/s
可用率100.0%
可用率100.0%
近期窗口内按调用量加权的平均值,不是分位数。没有成功样本的小时不计入,而不是算作 0。
端点
OpenAI Chat Completions
/v1/chat/completions/v1/chat/completionsOpenAI Responses
/v1/responses/v1/responsesAnthropic Messages
/v1/messages/v1/messagesGoogle Gemini
/v1beta/models/{model}:generateContent/v1beta/models/{model}:generateContentOpenAI Images
/v1/images/generations/v1/images/generations/v1/images/edits/v1/images/editsAlibaba Model Studio Video
/api/v1/services/aigc/video-generation/video-synthesis/api/v1/services/aigc/video-generation/video-synthesis/api/v1/tasks/{id}/api/v1/tasks/{id}MiniMax Video
/v2/video_generation/v2/video_generation/v2/query/video_generation/{id}/v2/query/video_generation/{id}Alibaba Model Studio Image
/api/v1/services/aigc/multimodal-generation/generation/api/v1/services/aigc/multimodal-generation/generation/api/v1/services/aigc/image-generation/generation/api/v1/services/aigc/image-generation/generationVolcengine Ark Video
/api/v3/contents/generations/tasks/api/v3/contents/generations/tasks/api/v3/contents/generations/tasks/{id}/api/v3/contents/generations/tasks/{id}xAI Video
/v1/videos/generations/v1/videos/generations/v1/videos/edits/v1/videos/edits/v1/videos/extensions/v1/videos/extensions/v1/videos/{id}/v1/videos/{id}Amux Tasks
/v1/tasks/v1/tasks/v1/tasks/{id}/v1/tasks/{id}/v1/tasks/{id}/cancel/v1/tasks/{id}/cancel支持的功能
流式输出
流式输出
推理
推理
函数调用
函数调用
结构化输出
结构化输出
提示缓存
提示缓存
视觉
视觉
图片生成
图片生成
对话内出图
对话内出图
视频生成
视频生成