Amux
全部模型

Anthropic: Claude Sonnet 5.5

正常

Anthropic: Claude Sonnet 5.5 是 Anthropic 升级版的 Sonnet 级模型,性能强于 Claude Sonnet 5,同时运行速度提升超过 30%,且在许多工作负载下成本更低。它专为代理式编码、工具使用和日常专业任务而设计,非常适合开发人员和团队构建快速且功能强大的 AI 智能体。

厂商:
Anthropic
输入类型:
输出类型:
上下文长度:
1M
最大输出:
128K
发布时间:
2026-09-28
toolsreasoningstructuredOutputstreamingvisioncaching

供应商

同一个模型,不同供应商。自动路由会在同一质量层级内挑选价格最优且健康的那个。

供应商
amazon-bedrock—$2/百万 tokens$10/百万 tokens
读$0.2/百万 tokens写 5m$2.5/百万 tokens写 1h$4/百万 tokens
1M——
减 30%anthropic—$2$1.4/百万 tokens$10$7/百万 tokens
读$0.2$0.14/百万 tokens写 5m$2.5$1.75/百万 tokens写 1h$4$2.8/百万 tokens
1M——
减 70%最低价amux-special0.00%$2$0.6/百万 tokens$10$3/百万 tokens
读$0.2$0.06/百万 tokens写 5m$2.5$0.75/百万 tokens写 1h$4$1.2/百万 tokens
1M2.4s216.9 tps

可用率

7 天

Amux 网关实际发出的请求在各供应商上的成功率。分母不含客户端错误——请求写错了不算供应商的账。

吞吐量

7 天

流式请求的平均吐字速率,单位为每秒 token 数(TPS)。

延迟

7 天

流式请求的平均首字延迟(TTFT),也就是从发出请求到收到第一个 token 的时间。

活动

7 天

该模型随时间变化的 token 用量与成本,按实际处理请求的供应商拆分。

相关模型

更多来自 Anthropic 的模型

Anthropic: Claude Opus 5.51M 上下文最低 $0.4 / 百万 tokens4 个供应商Anthropic: Claude Opus 5.5 是 Anthropic 旗下的旗舰模型,专为高要求的推理、编码和长周期智能体任务而设计,是 Claude Opus 5 的继任者。它在处理大型代码库的多步骤变更、代码审查与缺陷查找、金融与科学分析,以及解读密集型图表、示意图和截图方面表现尤为出色。与前代产品相比,它在引用数据和来源时更加严谨,确保仅陈述可证实的内容。 该模型以更少的步骤和 token 完成同类任务,并以更通俗的语言汇报工作成果,清晰地说明其操作过程、发现的问题以及需要用户配合的事项。模型思考过程始终保持自适应,因此“努力程度(effort)”是权衡深度、延迟和成本的主要杠杆,低努力程度的设置在对延迟敏感的工作负载中依然有效。
Anthropic: Claude Fable 5.11M 上下文最低 $3 / 百万 tokens3 个供应商Claude Fable 5.1 在各方面都比 Claude Fable 5 有所提升,最大的进步体现在智能代理编码、长期运行的智能代理工作流程以及知识工作方面:尤其是长代码重构、前端和可视化代码生成,以及财务和分析任务。它在计划和总结方面也比 Fable 5 更加简洁。我们建议在当前使用 Fable 5 的地方直接升级测试,同时在需要大量推理的任务中与 Opus 5 一起使用。
Anthropic: Claude Opus 51M 上下文最低 $0.5 / 百万 tokens4 个供应商Claude Opus 5 是 Anthropic 的旗舰模型,适用于要求较高的推理、编码和长期代理工作。它在端到端软件任务、代码审查和错误查找、图表和文档的可视化分析、复杂的办公室可交付成果以及协调并行子代理方面尤其强大。