Gemini 2.5 Flash Image(又称“Nano Banana”)现已全面推出。它是一款具备上下文理解能力的尖端图像生成模型,支持图像生成、编辑以及多轮对话。
- 输入类型:
- 输出类型:
- 输入:
- $0.3$0.255/百万
- 输出:
- $2.5$2.125/百万
- 上下文长度:
- 33K
- 最大输出:
- 8K
由 Google Vertex 提供的模型
Gemini 2.5 Flash Image(又称“Nano Banana”)现已全面推出。它是一款具备上下文理解能力的尖端图像生成模型,支持图像生成、编辑以及多轮对话。
Google: Nano Banana 2 (Gemini 3.1 Flash Image) 专为速度和效率而设计,可有效实现快速、交互式的响应以及高吞吐量。
Google: Nano Banana 2 Lite (Gemini 3.1 Flash-Lite Image) 是 Google 最快、最具成本效益的 Gemini 图像模型,专为高频开发流水线和快速视觉探索而构建。它能在约 5 秒内完成文本转图像生成,速度比 Gemini 3.1 Flash Image 快约 2.7 倍,同时保持了 Nano Banana 系列的角色一致性、精确编辑能力和现实世界知识。单一的嵌入式 API 可处理文本转图像、图像编辑和多图像合成。作为多模态模型,它还能在返回图像的同时生成文本。输出分辨率为 1K,支持 14 种宽高比,并带有不可见的 SynthID 水印,以便识别为 AI 生成。作为 Nano Banana 2 系列中质量与速度的最佳平衡点,它能以比重量级生产模型低得多的成本生成数千张图像,非常适合原型设计、实时应用程序和大规模视觉工作流。
Gemini 3.1 Pro 是 Gemini 系列模型的下一代产品,是一套高性能、原生多模式推理模型。 Gemini 3 Pro 现在是 Google 针对复杂任务最先进的模型,可以理解海量数据集,解决来自不同信息源的问题,包括文本、音频、图像、视频和整个代码存储库
Gemini 3.5 Flash 是谷歌的高效多模态模型,以 Flash 级的成本和速度带来接近专业级的编码和推理能力。它针对编码能力和并行代理执行循环进行了高度优化,支持文本、图像、视频、音频和 PDF 输入。
Gemini 3.5 Flash Lite是Google推出的一款高效模型,具有升级的代理能力。它适合在复杂的多代理工作流程中执行重点任务的子代理。
Gemini 3.6 Flash 是 Google 的一个高效模型,用于编码、代理工作流程以及 Web 和应用程序开发。它旨在产生精美的输出,减少不必要的编辑和对冲,同时减少令牌使用和完成任务所需的模型调用数量。
Gemini 3.7 Flash 是 Google 的多模式模型,用于快速代理工作流程、编码和复杂的多步骤推理。它专为需要响应性能和可靠的多步骤问题解决的任务而设计。
Gemini 3.8 Flash 是 Google 最智能的 Flash 模型,在软件工程、代理任务和多步推理方面较 3.7 Flash 有了显着的进步。
Google: Nano Banana Pro (Gemini 3 Pro Image) 是一款基于 Google Gemini 3 Pro 构建的 AI 图像生成模型,是其前代产品的一次重大升级。它旨在超越简单的模式匹配,转向一个更具推理驱动的系统,并在物理理解、文本渲染和图像一致性方面进行了改进。其主要功能包括更快的处理速度、原生 2K 分辨率以及对现有图像进行更高精度编辑的能力,旨在提供更可靠、专业级的生成结果。