Amux

模型对比

把几个模型并排放在一起比价格、上下文、性能、端点与功能。一列是一个模型在一家供应商上的报价——同一个模型放两列,比的就是两家。

对话

概览

开发者OpenAI
开发者OpenAI
上下文长度1.05M token
上下文长度1.05M token
最大输出128K token
最大输出128K token
推理支持
推理支持
输入类型
输入类型
输出类型
输出类型

价格

输入≤272K$2$1.6/百万 tokens>272K$4$3.2/百万 tokens
输入≤272K$2$0.1/百万 tokens>272K$4$0.2/百万 tokens
输出≤272K$12$9.6/百万 tokens>272K$18$14.4/百万 tokens
输出≤272K$12$0.6/百万 tokens>272K$18$0.9/百万 tokens
读取≤272K$0.2$0.16/百万 tokens>272K$0.4$0.32/百万 tokens
读取≤272K$0.2$0.01/百万 tokens>272K$0.4$0.02/百万 tokens
写入≤272K$2.5$2/百万 tokens>272K$5$4/百万 tokens
写入≤272K$2.5$0.125/百万 tokens>272K$5$0.25/百万 tokens
网络搜索$0.01$0.008/次
网络搜索$0.01$0.0005/次

性能

平均首字延迟7.64 s
平均首字延迟9.21 s
平均吐字速率144.8 tok/s
平均吐字速率264.6 tok/s
可用率100.0%
可用率99.9%

近期窗口内按调用量加权的平均值,不是分位数。没有成功样本的小时不计入,而不是算作 0。

端点

OpenAI Chat Completions

/v1/chat/completions
/v1/chat/completions

OpenAI Responses

/v1/responses
/v1/responses

Anthropic Messages

/v1/messages
/v1/messages

Google Gemini

/v1beta/models/{model}:generateContent
/v1beta/models/{model}:generateContent

OpenAI Images

/v1/images/generations
/v1/images/generations
/v1/images/edits
/v1/images/edits

Alibaba Model Studio Video

/api/v1/services/aigc/video-generation/video-synthesis
/api/v1/services/aigc/video-generation/video-synthesis
/api/v1/tasks/{id}
/api/v1/tasks/{id}

MiniMax Video

/v2/video_generation
/v2/video_generation
/v2/query/video_generation/{id}
/v2/query/video_generation/{id}

Amux Tasks

/v1/tasks
/v1/tasks
/v1/tasks/{id}
/v1/tasks/{id}
/v1/tasks/{id}/cancel
/v1/tasks/{id}/cancel

支持的功能

流式输出
流式输出
推理
推理
函数调用
函数调用
结构化输出
结构化输出
提示缓存
提示缓存
视觉
视觉
图片生成
图片生成
视频生成
视频生成