Claude Haiku 4.5 是 Anthropic 最快、最高效的模型,以较大 Claude 模型的一小部分成本和延迟提供近前沿的智能。 Haiku 4.5 与 Claude Sonnet 4 在推理、编码和计算机使用任务方面的性能相匹配,为实时和大容量应用程序带来了前沿水平的功能。
- 厂商:
- Anthropic
- 输入类型:
- 输出类型:
- 上下文长度:
- 200K
- 最大输出:
- 64K
- 发布时间:
- 2025-10-15
toolsreasoningstreamingcaching
供应商
同一个模型,不同供应商。自动路由会在同一质量层级内挑选价格最优且健康的那个。
| 供应商 | ||||
|---|---|---|---|---|
| amazon-bedrock | $1/百万 tokens | $5/百万 tokens | 读$0.1/百万 tokens写 5m$1.25/百万 tokens写 1h$2/百万 tokens | 200K |
| 减 30%anthropic | $1$0.7/百万 tokens | $5$3.5/百万 tokens | 读$0.1$0.07/百万 tokens写 5m$1.25$0.875/百万 tokens写 1h$2$1.4/百万 tokens | 200K |
| 减 90%最低价amazon-kiro | $1$0.1/百万 tokens | $5$0.5/百万 tokens | 读$0.1$0.01/百万 tokens写 5m$1.25$0.125/百万 tokens写 1h$2$0.2/百万 tokens | 200K |
可用率
24 小时Amux 网关实际发出的请求在各供应商上的成功率。分母不含客户端错误——请求写错了不算供应商的账。
吞吐量
24 小时流式请求的平均吐字速率,单位为每秒 token 数(TPS)。
延迟
24 小时流式请求的平均首字延迟(TTFT),也就是从发出请求到收到第一个 token 的时间。
活动
24 小时该模型随时间变化的 token 用量与成本,按实际处理请求的供应商拆分。
相关模型
更多来自 Anthropic 的模型
Anthropic: Claude Fable 5.11M 上下文最低 $7 / 百万 tokens2 个供应商Claude Fable 5.1 在各方面都比 Claude Fable 5 有所提升,最大的进步体现在智能代理编码、长期运行的智能代理工作流程以及知识工作方面:尤其是长代码重构、前端和可视化代码生成,以及财务和分析任务。它在计划和总结方面也比 Fable 5 更加简洁。我们建议在当前使用 Fable 5 的地方直接升级测试,同时在需要大量推理的任务中与 Opus 5 一起使用。
Anthropic: Claude Opus 51M 上下文最低 $0.5 / 百万 tokens3 个供应商Claude Opus 5 是 Anthropic 的旗舰模型,适用于要求较高的推理、编码和长期代理工作。它在端到端软件任务、代码审查和错误查找、图表和文档的可视化分析、复杂的办公室可交付成果以及协调并行子代理方面尤其强大。
Anthropic: Claude Sonnet 51M 上下文最低 $0.3 / 百万 tokens3 个供应商Claude Sonnet 5 被打造为迄今为止最具活力的 Sonnet 模型。它可以规划、使用浏览器和终端等工具,并以最近才需要更大、更昂贵的模型的水平自主运行。