Amux

快速开始

最近更新:2026年8月26日

拿到 API 密钥、把 base_url 指向 Amux、发出第一个请求。

完成第一个请求,通常只需要调整两项:地址密钥

四步

  1. 登录 Amux
  2. 给账户充值
  3. 创建一把 API 密钥
  4. 发出第一个请求

1. 登录并选好用哪个账户

注册后会自动创建一个个人工作区,可直接使用。团队协作场景则应创建组织;余额、成员和权限都在组织层管理,并与个人工作区完全隔离。

余额属于账户层:个人账户一份,每个组织账户各一份,彼此独立。充值前应先确认费用归属。详见组织与工作区

2. 充值

在控制台充值。目前采用预充值 + 按实际消耗扣费的方式:调用按供应商价格结算,推理部分不额外加价。

订阅制计费尚未上线,本页会在能力发布后同步更新。

3. 创建密钥

在控制台的 API 密钥 页面创建密钥。密钥创建后仍可在该页面再次查看,无需重新生成。

密钥绑定在工作区上:该密钥产生的费用会记入所属工作区对应的账户。建议为不同项目分别创建密钥,便于在控制台按密钥区分用量。

4. 发出第一个请求

Amux 原生兼容 OpenAI 协议,因此官方 SDK 可直接使用:

from openai import OpenAI

client = OpenAI(
    base_url="https://gateway.amux.ai/v1",
    api_key="你的 Amux 密钥",
)

response = client.chat.completions.create(
    model="anthropic/claude-opus-5",
    messages=[{"role": "user", "content": "用一句话解释什么是 API 网关"}],
)

print(response.choices[0].message.content)
curl https://gateway.amux.ai/v1/chat/completions \
  -H "Authorization: Bearer $AMUX_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "anthropic/claude-opus-5",
    "messages": [{"role": "user", "content": "Hello"}]
  }'

model 使用 厂商/模型 形式的规范 ID。从其他环境迁移来的常见裸名(如 claude-haiku-4-5-20251001)通常也可使用,因为平台维护了常见别名。

支持的协议

四种协议均为原生实现,不是转译。应根据客户端使用的协议选择地址,而不是根据目标模型选择地址:

协议端点鉴权头
OpenAI Chat Completionshttps://gateway.amux.ai/v1/chat/completionsAuthorization: Bearer
OpenAI Responseshttps://gateway.amux.ai/v1/responsesAuthorization: Bearer
Anthropic Messageshttps://gateway.amux.ai/v1/messagesx-api-key
Google Geminihttps://gateway.amux.ai/v1beta/models/{model}:generateContentx-goog-api-key

协议与模型是两个独立维度。 可以用 OpenAI SDK 调 Claude,也可以用 Anthropic SDK 调 Gemini;但并非每个模型都支持所有协议,模型详情页会列出实际可用协议。跨协议调用的参数差异见协议转换参数兼容性

选供应商与路由策略

同一个模型往往有好几家在提供,价格、上下文长度、支持的协议都可能不同。

锁定某一家,在模型名后加冒号:

{ "model": "anthropic/claude-opus-5:anthropic" }

锁定后若该供应商不可用,请求会直接失败,不会自动切换到其他供应商。需要确定性时适合锁定;需要更高可用性时则应保留自动路由。

不锁供应商时指定排序,用 @ 后缀:

后缀排序依据
@balanced按渠道权重加权随机。默认值
@price综合单价低的优先
@latency首字延迟低的优先
@throughput输出速度快的优先
@reliability成功率高的优先

完整说明见 API 参考。默认策略也可在设置中配置:个人设置作用于个人工作区,组织设置作用于该组织下的全部工作区。

确认账单

调用完成后,可在控制台的用量页查看费用、命中的供应商,以及各类 token 的分布。推理部分按供应商价格结算。

路由重试中失败的尝试不计费。若客户端在中途断开,已产生的用量仍会计费,因为对应内容已经由上游生成。

接下来