GPT-5.6 Terra 是 OpenAI GPT-5.6 系列中的平衡型号,定位于旗舰 Sol 层和经济高效的 Luna 层之间。它适用于需要平衡能力和成本的日常编码、推理和代理任务,以大约 Sol 一半的成本提供强大的性能。
- 厂商:
- OpenAI
- 输入类型:
- 输出类型:
- 上下文长度:
- 1.05M
- 最大输出:
- 128K
- 发布时间:
- 2026-07-10
toolsreasoningstructuredOutputstreamingvisioncaching
供应商
同一个模型,不同供应商。自动路由会在同一质量层级内挑选价格最优且健康的那个。
| 供应商 | ||||
|---|---|---|---|---|
| 减 20%azure | $2-4$1.6-3.2/百万 tokens | $12-18$9.6-14.4/百万 tokens | 读$0.2-0.4$0.16-0.32/百万 tokens写$2.5-5$2-4/百万 tokens | 1.05M |
| 减 95%最低价amux-special | $2-4$0.1-0.2/百万 tokens | $12-18$0.6-0.9/百万 tokens | 读$0.2-0.4$0.01-0.02/百万 tokens写$2.5-5$0.125-0.25/百万 tokens | 1.05M |
可用率
24 小时Amux 网关实际发出的请求在各供应商上的成功率。分母不含客户端错误——请求写错了不算供应商的账。
吞吐量
24 小时流式请求的平均吐字速率,单位为每秒 token 数(TPS)。
延迟
24 小时流式请求的平均首字延迟(TTFT),也就是从发出请求到收到第一个 token 的时间。
活动
24 小时该模型随时间变化的 token 用量与成本,按实际处理请求的供应商拆分。
相关模型
更多来自 OpenAI 的模型
OpenAI: GPT-6 Astra1.05M 上下文最低 $0.5 / 百万 tokens2 个供应商GPT-6 Astra 是 OpenAI 的旗舰模型,适用于要求苛刻的端到端工作。它适用于高级分析、软件工程、深入研究、科学工作和文档创建,在涉及计算机和浏览器使用的长期代理任务中具有特殊优势。
OpenAI: GPT-5.6 Luna1.05M 上下文最低 $0.1 / 百万 tokens2 个供应商GPT-5.6 Luna 是 OpenAI GPT-5.6 系列中快速、经济高效的型号。它适用于大容量、延迟敏感的任务,例如聊天、分类和轻量级代理工作流程,为其价格层提供有力的推理。
OpenAI: GPT-5.6 Sol1.05M 上下文最低 $0.25 / 百万 tokens2 个供应商GPT-5.6 Sol是OpenAI GPT-5.6系列中的旗舰型号。它适用于复杂的推理、编码和代理工作流程,并且在命令行和多步骤编码任务以及长期问题解决方面尤其强大。