Amux
全部模型

Z.ai: GLM 5.3

正常

GLM-5.3 是 Z.ai 的大规模推理模型,专为复杂的软件工程和长期代理任务而构建。它支持具有 1M-token 上下文窗口的文本输入和输出,并在编码以及性能和令牌效率之间的平衡方面改进了 GLM-5.2。

厂商:
Z.ai
输入类型:
输出类型:
上下文长度:
1M
最大输出:
128K
发布时间:
2026-08-13
toolsreasoningstructuredOutputstreamingcaching

供应商

同一个模型,不同供应商。自动路由会在同一质量层级内挑选价格最优且健康的那个。

供应商
减 70%amux-special$1.4$0.42/百万 tokens$4.4$1.32/百万 tokens
$0.26$0.078/百万 tokens
1M

可用率

24 小时

Amux 网关实际发出的请求在各供应商上的成功率。分母不含客户端错误——请求写错了不算供应商的账。

吞吐量

24 小时

流式请求的平均吐字速率,单位为每秒 token 数(TPS)。

延迟

24 小时

流式请求的平均首字延迟(TTFT),也就是从发出请求到收到第一个 token 的时间。

活动

24 小时

该模型随时间变化的 token 用量与成本,按实际处理请求的供应商拆分。

相关模型

更多来自 Z.ai 的模型

Z.ai: GLM 5.3 Flash1M 上下文最低 $0.045 / 百万 tokens1 个供应商GLM-5.3-Flash 是 Z.ai 的原生多模式模型。它适合高效编码和长期代理任务。其混合稀疏和线性注意架构保持准确的长上下文行为,同时减少计算开销。
Z.ai: GLM 5.21M 上下文最低 $0.42 / 百万 tokens1 个供应商GLM 5.2是Z.ai的大规模推理模型。它支持使用 1M 令牌上下文窗口进行文本输入和输出,适用于长期代理工作流程、项目级软件工程和复杂的多步骤自动化。