简介
最近更新:2026年8月26日
Amux 是一个大模型 API 网关:一个地址接入所有主流模型,按供应商比价调用,推理零加价。
Amux 是一个大模型 API 网关。请求发送到 https://gateway.amux.ai 后,平台会按配置转发给上游模型供应商,并返回结果,同时统一鉴权、计费、路由与观测。
Amux 不训练模型,也不托管模型,专注于模型调用这一层。
要解决的问题
接入一家模型供应商并不复杂;难点在于同时接入多家后,重复的 SDK、鉴权、账单和可用性处理会持续放大维护成本。
这还不是一次性的接入成本。模型持续更新、价格持续变化,而更换模型不应意味着重新改代码、测试和上线。
Amux 将这一层收敛为统一的接入面。
设计原则
推理不抽成
同一个模型往往有好几家供应商在提供,价格与上下文长度都不同。我们把每一家逐条列在模型目录里,按供应商原价计费。我们拿到的供应商折扣直接进入你看到的单价,不是留在中间。
这也决定了平台的其它设计选择:路由不依赖价差盈利,因此没有必要将请求导向更高价的供应商,也没有必要隐藏价格。
协议原生兼容,不是转译
OpenAI Chat Completions、OpenAI Responses、Anthropic Messages 和 Google Gemini 四种协议均为原生实现。Claude Code、Codex、Gemini CLI 等仅支持单一协议的工具,通常只需调整 base_url 即可接入。
同一个模型也可以跨协议调:用 OpenAI 的 SDK 调 Claude、用 Anthropic 的 SDK 调 Gemini 都可以。跨协议时哪些参数会变,见协议转换参数兼容性。
不静默降级
对于不支持的能力组合,平台会明确返回错误,而不会静默替换为近似行为,以避免调用方在生产环境中收到与预期不一致的结果。
你的数据是你的
我们不用你的请求或响应内容训练任何模型。请求与响应的正文是否记录,由你按密钥或按调用自己控制。详见隐私政策。
失败要说清楚
错误体中会尽量保留上游返回的原始信息,例如 CUDA out of memory 这类对排障有帮助的内容。路由重试中失败的尝试不计费。
每次调用都会保留完整记录,包括入参、产物、用量、命中的供应商,以及失败时的上游返回信息。
我们不做什么
清晰的边界通常比宽泛的能力列表更重要:
- 不做模型评测与排行。模型优劣高度依赖具体任务场景,而提供调用服务的平台不适合作为统一评测方
- 不做提示词托管、不做 Agent 框架。那一层生态已经很热闹,我们做它下面那一层
- 不锁定。模型名是标准的「厂商/模型」格式,协议是业界既有的,换回直连或换到别家,改的还是那两行
现在做到了哪一步
已经上线的:四种协议的推理端点、模型目录与比价、按量计费、API 密钥与用量看板、跨供应商路由与熔断、组织与工作区。
规划中的能力包括订阅制计费、更完整的多模态支持,以及控制台中的成本分析功能。本页仅描述当前已上线能力,并会随实际进度更新。