Google DeepMind发布Nano Banana 2 Lite和Gemini Omni Flash,覆盖边缘计算和高性能推理需求。
我们通过推出 Nano Banana 2 Lite(我们最快、最成本高效的 Gemini 图像模型)和 Gemini Omni Flash(用于高质量视频生成和对话式编辑),让您更轻松地尝试和扩展您的想法。
Google DeepMind 产品经理
Google DeepMind 产品经理
今天,我们发布了两个重大更新,让您更快更轻松地尝试、优化和扩展您的创意:
推出 Nano Banana 2 Lite:我们 Nano Banana 系列中最快、最成本高效的图像模型,专为高吞吐量、速度和规模构建。Nano Banana 2 Lite 今日可在 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 中使用。它也在今天推出到 Google 消费者产品中,包括搜索中的 AI Mode、Gemini 应用以及许多其他产品。
为开发者推出 Gemini Omni Flash:这是一个高质量、成本高效的模型,用于视频生成和对话式编辑,现已首次在 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 中提供。Omni Flash 也在 Gemini 应用和 Google Flow 中可用。
用生成式媒体构建项目通常涉及创意迭代。通过这两个模型,开发者可以构建全面的端到端多媒体体验,将快速图像生成与视频创建和编辑相连接。无论您的工作流是需要生成数千张图像还是编辑多轮视频序列,您现在都有两个新模型来加快构建速度、无缝迭代并将您的创意愿景变为现实。
观看 Nano Banana 2 Lite 和 Nano Banana 2 在使用简单提示词时的图像生成速度和质量的并排对比。
Nano Banana 2 Lite(gemini-3.1-flash-lite-image)为快速构思和高速开发者流水线而设计,其中速度和成本是主要约束。它是我们为目前使用第一版 Nano Banana(gemini-2.5-flash-image)的开发者推荐的替代方案,您可以立即替换以获得关键性能指标的立竿见影的收益。
Nano Banana 2 和 2 Lite 与竞争对手 AI 图像模型的性能基准,评估了生成/编辑质量(Elo 评分)、处理延迟和每 1K 分辨率图像成本之间的权衡。
Nano Banana 2 Lite 的优势在于:
延迟:在 4 秒内交付文本到图像的输出。这使其非常适合交互式原型和快速视觉草图。
成本效率(每 1K 图像 $0.034):为专注于草图、构思、管理运营预算或低带宽使用的开发者提供成本高效的选择。
尽管优先考虑速度,Nano Banana 2 Lite 仍然保持了可靠的提示词遵循、强大的角色一致性和清晰的图像内文字渲染。
Nano Banana 2 Lite(Gemini 3.1 Flash Lite Image):为速度而生。针对需要超低延迟的接近实时、高容量工作流进行优化。
Nano Banana 2(Gemini 3.1 Flash Image):通用主力军。在较低延迟下提供高质量,提供性能和成本的最佳平衡。
Nano Banana Pro(Gemini 3 Pro Image):针对复杂的专业用例进行优化。它为精确性比速度更重要的任务提供最强大的控制和高级推理能力。
Nano Banana(Gemini 2.5 Flash Image):我们的遗留模型。我们建议升级到 Nano Banana 2 Lite 以获得更好的质量、更快的速度和更低的成本。
要查看完整的模型功能列表以及如何集成,请查阅开发者文档。
除了在开发者平台上发布外,Nano Banana 2 Lite 还将推出到 Google 消费者产品,包括搜索中的 AI Mode、Gemini 应用、NotebookLM、Google Photos、Stitch、Google Flow 和 Google Ads。
观看有人用 Gemini Omni 演示四个数字魔术,比如从她的手机中拉出一个 3D 气球字体,以及从屏幕倒水到玻璃杯中。角落里有一个小的"原始"视频,显示了她在 Omni 生成的特效被添加之前实际拍摄这些魔术的方式。
在 Google I/O 上,我们介绍了 Gemini Omni Flash,这是 Gemini 的多模态推理与视频生成和编辑相结合的模型。今天,Gemini Omni Flash(gemini-omni-flash-preview)向开发者推出,通过 Gemini API 和 Google AI Studio 可用,原生支持文本、图像和视频输入的组合进行高质量视频生成和对话式编辑。这个模型的定价具有竞争力,为每秒视频输出 $0.10,与 Veo 3.1 Fast 相同。
Omni Flash 的优势在于:
对话式视频编辑:使用自然语言优化和编辑视频。
多模态引用:结合图像、文本和视频等输入来维持对场景的控制和一致性。
真实世界知识:Omni 利用 Gemini 的知识(如历史、生物学和叙事逻辑)来构建引人注目的视频。
文本和动作同步:通过简单的提示词,将文本和图形直接连接到视频动作。
有关全面的基准信息,请访问 Google DeepMind 的 Gemini Omni 网页。
Omni 目前提供 10 秒的视频生成,更长的时长即将推出。
上传音频参考和场景扩展功能目前在 Gemini API 中对此模型不受支持。
API 架构接受最长 3 秒的视频参考,但模型目前无法正确处理。
更换场景或平移运动时的角色一致性有一些限制,但我们正在努力改进。
Gemini Omni 从今天开始在 Google AI Studio 和 Gemini API 中以公测版提供。要查看完整的模型功能列表和地区特定限制,请查阅开发者文档。
真正的魔力发生在您将这两个模型链接在一起时。使用 Nano Banana 2 Lite 作为高速图像生成模型,然后将该图像作为参考传递给 Gemini Omni Flash 以将其制作成高质量视频。此外,通过对这些多轮体验使用 Interactions API,您可以维持会话历史和上下文,这样用户可以堆积最多三个连续编辑。
为了帮助您开始,我们创建了一些演示应用,您可以重新编辑,让您体验如何将 Nano Banana 2 Lite 和 Gemini Omni Flash 配对到一个工作流中。
Anywhere 是一个演示应用,展示了两个模型的强大功能。拍一张自拍照或上传一张照片,该应用使用 Nano Banana 2 Lite 将您瞬间传送到数十个标志性地标。然后,当点击图像时,使用 Omni Flash 将生成的图像转换为该位置的动画片段。
Space Lift 是一个由 Nano Banana 2 Lite 和 Gemini Omni 驱动的演示室内设计应用,可让您通过上传照片立即重新构思任何房间。该应用自动在各种设计美学中生成充分实现的概念。一旦您找到您喜欢的外观,点击视频按钮就可以观看 Omni 如何通过电影般的展示使设计生动起来,让您在改造成现实之前在运动中体验您的新空间。
Omni product studio 是一个演示应用,将由 Nano Banana 2 Lite 创建的静态图像转换为由 Gemini Omni 创建的电影电子商务视频。这个演示展示了通过与图像到视频输出的快速交互来合并多模态输入来构建交互式媒体。
基于 Google 的安全基础设施构建,Gemini Omni 和 Nano Banana 2 Lite 使用 SynthID 水印。您可以通过 Gemini 应用、Gemini in Chrome 或搜索来验证 AI 内容。了解更多关于我们如何扩展验证工具,帮助您了解内容如何在整个网络上创建和编辑的信息。
Nano Banana 2 Lite 资源:
前往 Google AI Studio 在操场上尝试该模型。
深入了解我们的 Gemini API 文档。
查看我们的 Nano Banana 提示词指南,其中充满了最佳实践和示例提示词。
Gemini Omni Flash 资源:
前往 Google AI Studio 在操场上尝试该模型。
深入了解我们的 Gemini API 文档。
查看我们的 Gemini Omni Flash 提示词指南,其中充满了最佳实践和示例提示词。