Gemini 3.7 Flash 是 Google 的多模式模型,用于快速代理工作流程、编码和复杂的多步骤推理。它专为需要响应性能和可靠的多步骤问题解决的任务而设计。
- 厂商:
- 输入类型:
- 输出类型:
- 上下文长度:
- 1.05M
- 最大输出:
- 66K
- 发布时间:
- 2026-08-13
toolsreasoningstructuredOutputstreamingvisioncaching
供应商
同一个模型,不同供应商。自动路由会在同一质量层级内挑选价格最优且健康的那个。
| 供应商 | ||||
|---|---|---|---|---|
| 减 15%google-vertex | $1.5$1.275/百万 tokens | $7.5$6.375/百万 tokens | 读$0.15$0.1275/百万 tokens写— | 1.05M |
可用率
24 小时Amux 网关实际发出的请求在各供应商上的成功率。分母不含客户端错误——请求写错了不算供应商的账。
吞吐量
24 小时流式请求的平均吐字速率,单位为每秒 token 数(TPS)。
延迟
24 小时流式请求的平均首字延迟(TTFT),也就是从发出请求到收到第一个 token 的时间。
活动
24 小时该模型随时间变化的 token 用量与成本,按实际处理请求的供应商拆分。
相关模型
更多来自 Google 的模型
Google: Gemini 3.8 Flash1.05M 上下文最低 $0.75 / 百万 tokens1 个供应商Gemini 3.8 Flash 是 Google 最智能的 Flash 模型,在软件工程、代理任务和多步推理方面较 3.7 Flash 有了显着的进步。
Google: Gemini 3.5 Flash Lite1.05M 上下文最低 $0.255 / 百万 tokens1 个供应商Gemini 3.5 Flash Lite是Google推出的一款高效模型,具有升级的代理能力。它适合在复杂的多代理工作流程中执行重点任务的子代理。
Google: Gemini 3.6 Flash1.05M 上下文最低 $1.275 / 百万 tokens1 个供应商Gemini 3.6 Flash 是 Google 的一个高效模型,用于编码、代理工作流程以及 Web 和应用程序开发。它旨在产生精美的输出,减少不必要的编辑和对冲,同时减少令牌使用和完成任务所需的模型调用数量。