Amux
全部模型

Tencent: Hy4 Preview

正常

Tencent: Hy4 Preview 是腾讯推出的混合专家(MoE)模型,总参数量为 770B,激活参数量为 49B。它专为编码智能体、复杂工具使用工作流,以及需要规划、上下文连续性和持续多步执行的生产力任务而设计。

厂商:
Tencent
输入类型:
输出类型:
上下文长度:
1.05M
最大输出:
64K
发布时间:
2026-08-28
toolsreasoningstructuredOutputstreamingcaching

供应商

同一个模型,不同供应商。自动路由会在同一质量层级内挑选价格最优且健康的那个。

供应商
减 35%tencent-cloud—$0.834$0.5421/百万 tokens$2.501$1.6257/百万 tokens
读$0.042$0.0273/百万 tokens写—
1.05M——

可用率

7 天

Amux 网关实际发出的请求在各供应商上的成功率。分母不含客户端错误——请求写错了不算供应商的账。

吞吐量

7 天

流式请求的平均吐字速率,单位为每秒 token 数(TPS)。

延迟

7 天

流式请求的平均首字延迟(TTFT),也就是从发出请求到收到第一个 token 的时间。

活动

7 天

该模型随时间变化的 token 用量与成本,按实际处理请求的供应商拆分。

相关模型

更多来自 Tencent 的模型

Tencent: Hy3262K 上下文最低 $0.0858 / 百万 tokens1 个供应商Tencent: Hy3 是腾讯推出的一款混合专家模型,拥有 7700 亿总参数,其中 490 亿为激活参数。它专为编码智能体、复杂工具使用工作流,以及需要规划、上下文连续性和持续多步执行的生产力任务而设计。