Amux

简介

最近更新:2026年8月26日

Amux 是一个大模型 API 网关:一个地址接入所有主流模型,按供应商比价调用,推理零加价。

Amux 是一个大模型 API 网关。请求发送到 https://gateway.amux.ai 后,平台会按配置转发给上游模型供应商,并返回结果,同时统一鉴权、计费、路由与观测。

Amux 不训练模型,也不托管模型,专注于模型调用这一层。

要解决的问题

接入一家模型供应商并不复杂;难点在于同时接入多家后,重复的 SDK、鉴权、账单和可用性处理会持续放大维护成本。

这还不是一次性的接入成本。模型持续更新、价格持续变化,而更换模型不应意味着重新改代码、测试和上线。

Amux 将这一层收敛为统一的接入面。

设计原则

推理不抽成

同一个模型往往有好几家供应商在提供,价格与上下文长度都不同。我们把每一家逐条列在模型目录里,按供应商原价计费。我们拿到的供应商折扣直接进入你看到的单价,不是留在中间。

这也决定了平台的其它设计选择:路由不依赖价差盈利,因此没有必要将请求导向更高价的供应商,也没有必要隐藏价格。

协议原生兼容,不是转译

OpenAI Chat Completions、OpenAI Responses、Anthropic Messages 和 Google Gemini 四种协议均为原生实现。Claude Code、Codex、Gemini CLI 等仅支持单一协议的工具,通常只需调整 base_url 即可接入。

同一个模型也可以跨协议调:用 OpenAI 的 SDK 调 Claude、用 Anthropic 的 SDK 调 Gemini 都可以。跨协议时哪些参数会变,见协议转换参数兼容性

不静默降级

对于不支持的能力组合,平台会明确返回错误,而不会静默替换为近似行为,以避免调用方在生产环境中收到与预期不一致的结果。

你的数据是你的

我们不用你的请求或响应内容训练任何模型。请求与响应的正文是否记录,由你按密钥或按调用自己控制。详见隐私政策

失败要说清楚

错误体中会尽量保留上游返回的原始信息,例如 CUDA out of memory 这类对排障有帮助的内容。路由重试中失败的尝试不计费。

每次调用都会保留完整记录,包括入参、产物、用量、命中的供应商,以及失败时的上游返回信息。

我们不做什么

清晰的边界通常比宽泛的能力列表更重要:

  • 不做模型评测与排行。模型优劣高度依赖具体任务场景,而提供调用服务的平台不适合作为统一评测方
  • 不做提示词托管、不做 Agent 框架。那一层生态已经很热闹,我们做它下面那一层
  • 不锁定。模型名是标准的「厂商/模型」格式,协议是业界既有的,换回直连或换到别家,改的还是那两行

现在做到了哪一步

已经上线的:四种协议的推理端点、模型目录与比价、按量计费、API 密钥与用量看板、跨供应商路由与熔断、组织与工作区。

规划中的能力包括订阅制计费、更完整的多模态支持,以及控制台中的成本分析功能。本页仅描述当前已上线能力,并会随实际进度更新。

从哪儿开始

建议先阅读快速开始,完成密钥创建并发出第一个请求。团队协作场景可参考组织与工作区,跨协议调用可参考协议转换参数兼容性

法律相关的文本见服务条款隐私政策