Anthropic: Claude Sonnet 5.5 是 Anthropic 升级版的 Sonnet 级模型,性能强于 Claude Sonnet 5,同时运行速度提升超过 30%,且在许多工作负载下成本更低。它专为代理式编码、工具使用和日常专业任务而设计,非常适合开发人员和团队构建快速且功能强大的 AI 智能体。
- 厂商:
- Anthropic
- 输入类型:
- 输出类型:
- 上下文长度:
- 1M
- 最大输出:
- 128K
- 发布时间:
- 2026-09-28
toolsreasoningstructuredOutputstreamingvisioncaching
供应商
同一个模型,不同供应商。自动路由会在同一质量层级内挑选价格最优且健康的那个。
| 供应商 | |||||||
|---|---|---|---|---|---|---|---|
| amazon-bedrock | — | $2/百万 tokens | $10/百万 tokens | 读$0.2/百万 tokens写 5m$2.5/百万 tokens写 1h$4/百万 tokens | 1M | — | — |
| 减 30%anthropic | — | $2$1.4/百万 tokens | $10$7/百万 tokens | 读$0.2$0.14/百万 tokens写 5m$2.5$1.75/百万 tokens写 1h$4$2.8/百万 tokens | 1M | — | — |
| 减 70%最低价amux-special | 0.00% | $2$0.6/百万 tokens | $10$3/百万 tokens | 读$0.2$0.06/百万 tokens写 5m$2.5$0.75/百万 tokens写 1h$4$1.2/百万 tokens | 1M | 2.4s | 216.9 tps |
可用率
7 天Amux 网关实际发出的请求在各供应商上的成功率。分母不含客户端错误——请求写错了不算供应商的账。
吞吐量
7 天流式请求的平均吐字速率,单位为每秒 token 数(TPS)。
延迟
7 天流式请求的平均首字延迟(TTFT),也就是从发出请求到收到第一个 token 的时间。
活动
7 天该模型随时间变化的 token 用量与成本,按实际处理请求的供应商拆分。
相关模型
更多来自 Anthropic 的模型
Anthropic: Claude Opus 5.51M 上下文最低 $0.4 / 百万 tokens4 个供应商Anthropic: Claude Opus 5.5 是 Anthropic 旗下的旗舰模型,专为高要求的推理、编码和长周期智能体任务而设计,是 Claude Opus 5 的继任者。它在处理大型代码库的多步骤变更、代码审查与缺陷查找、金融与科学分析,以及解读密集型图表、示意图和截图方面表现尤为出色。与前代产品相比,它在引用数据和来源时更加严谨,确保仅陈述可证实的内容。
该模型以更少的步骤和 token 完成同类任务,并以更通俗的语言汇报工作成果,清晰地说明其操作过程、发现的问题以及需要用户配合的事项。模型思考过程始终保持自适应,因此“努力程度(effort)”是权衡深度、延迟和成本的主要杠杆,低努力程度的设置在对延迟敏感的工作负载中依然有效。
Anthropic: Claude Fable 5.11M 上下文最低 $3 / 百万 tokens3 个供应商Claude Fable 5.1 在各方面都比 Claude Fable 5 有所提升,最大的进步体现在智能代理编码、长期运行的智能代理工作流程以及知识工作方面:尤其是长代码重构、前端和可视化代码生成,以及财务和分析任务。它在计划和总结方面也比 Fable 5 更加简洁。我们建议在当前使用 Fable 5 的地方直接升级测试,同时在需要大量推理的任务中与 Opus 5 一起使用。
Anthropic: Claude Opus 51M 上下文最低 $0.5 / 百万 tokens4 个供应商Claude Opus 5 是 Anthropic 的旗舰模型,适用于要求较高的推理、编码和长期代理工作。它在端到端软件任务、代码审查和错误查找、图表和文档的可视化分析、复杂的办公室可交付成果以及协调并行子代理方面尤其强大。