Google DeepMind:Blog(RSS)
精选
70AI 编辑部评分,满分 100

Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash

2026-07-01 00:02· 45天前· Alisa Fortin
AI 导读

Google DeepMind 推出 Nano Banana 2 Lite(gemini-3.1-flash-lite-image),为 Nano Banana 系列速度最快、成本最低的图像模型,文本到图像输出仅需 4 秒,每 1K 分辨率图像成本 $0.034,已上线 Google AI Studio、Gemini API 及消费者产品(AI Mode in Search、Gemini app 等)。同时推出 Gemini Omni Flash(gemini-omni-flash-preview),支持高画质视频生成与对话式编辑,视频输出定价 $0.10/秒,面向开发者开放 API。

推荐理由

Nano Banana 2 Lite 把图像生成拉到 4 秒延迟和 0.034 美元单价,很适合高频草稿流,Omni Flash 首次对开发者开放视频生成和对话编辑,两个模型串起来的快速迭代工作流是这次最实用的更新。

正文 · AI 翻译

我们正在通过 Nano Banana 2 Lite(我们最快、最具成本效益的 Gemini 图像模型)以及 Gemini Omni Flash(用于高质量视频生成和对话式编辑)来降低实验和扩展创意的门槛。

Alisa Fortin

产品经理,Google DeepMind

Anish Nangia

产品经理,Google DeepMind

今天,我们通过两项重大发布,让您能够更快速、更轻松地实验、优化和扩展您的创意:

  • 推出 Nano Banana 2 Lite:这是 Nano Banana 系列中迄今为止最快、最具成本效益的图像模型,专为高吞吐量、高速度和大规模应用而构建。Nano Banana 2 Lite 即日起在 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 中可用。同时,它也在今天开始向 Google 消费者端产品推送,包括搜索中的 AI 模式、Gemini 应用以及众多其他产品。
  • 向开发者推出 Gemini Omni Flash:我们用于视频生成和对话式编辑的高质量、高成本效益模型,现首次在 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 中提供。Omni Flash 也已在 Gemini 应用和 Google Flow 中可用。

使用生成式媒体进行开发往往是一个创意迭代的过程。借助这两个模型,开发者可以构建全面的端到端多媒体体验,将快速图像生成与视频创建和编辑无缝衔接。无论您的工作流程是需要生成数千张图像,还是编辑多轮视频序列,您现在都拥有了两个新模型,可以更快速地构建、无缝迭代,并将您的创意愿景变为现实。

Nano Banana 2 Lite:我们最快、最具成本效益的 Gemini 图像模型

观看 Nano Banana 2 Lite 与 Nano Banana 2 在使用简单提示词时图像生成速度和质量的并排对比。

Nano Banana 2 Lite(gemini-3.1-flash-lite-image)专为快速构思和高速开发者流水线而设计,在这些场景中,速度和成本是首要约束条件。它是我们为当前使用第一版 Nano Banana(gemini-2.5-flash-image)的开发者推荐的替代模型,您现在即可进行替换,在关键性能维度上立即获得收益。

Nano Banana 2 和 2 Lite 与竞品 AI 图像模型的性能基准对比,评估了生成/编辑质量(Elo 评分)、处理延迟以及每张 1K 分辨率图像的成本之间的权衡。

Nano Banana 2 Lite 在以下方面表现出色:

  • 延迟:文本到图像输出仅需 4 秒。这使其成为交互式原型设计和快速视觉草稿绘制的理想选择。
  • 成本效益(每张 1K 图像 0.034 美元):对于专注于草稿绘制、构思、管理运营预算或低带宽使用的开发者来说,这是一个高性价比的选择。

尽管优先考虑速度,Nano Banana 2 Lite 仍保持了可靠的提示词遵循能力、强大的人物一致性以及清晰的图像内文本渲染。

了解 Nano Banana 系列

  • Nano Banana 2 Lite(Gemini 3.1 Flash Lite Image):专为速度而构建。针对超低延迟至关重要的近实时、高吞吐量工作流进行了优化。
  • Nano Banana 2(Gemini 3.1 Flash Image):通用型主力模型。以较低延迟提供高质量,实现了性能与成本的最佳平衡。
  • Nano Banana Pro(Gemini 3 Pro Image):针对复杂的专业用例进行了优化。它为准确性比速度更重要的任务提供了最强大的控制和高级推理能力。
  • Nano Banana(Gemini 2.5 Flash Image):我们的上一代模型。我们建议升级到 Nano Banana 2 Lite,以获得更好的质量、更快的速度和更低的成本。

如需查看完整的模型能力列表以及如何集成,请查阅开发者文档。

除了在开发者平台上发布外,Nano Banana 2 Lite 还将登陆 Google 的消费者产品,包括搜索中的 AI 模式、Gemini 应用、NotebookLM、Google Photos、Stitch、Google Flow 和 Google Ads。

通过 Gemini Omni Flash 体验高质量、高性价比的视频编辑与生成

观看某人使用 Gemini Omni 表演四个数字魔术,例如从手机中拉出一个 3D 气球文字,以及将屏幕中的水倒入玻璃杯。角落里的一个小“原始”视频揭示了她在添加 Omni 生成的特效之前实际拍摄这些魔术的方式。

在 Google I/O 大会上,我们推出了 Gemini Omni Flash,这是一款将 Gemini 多模态推理能力与视频生成和编辑相结合的大模型。今天,Gemini Omni Flash(gemini-omni-flash-preview)已通过 Gemini API 和 Google AI Studio 向开发者开放,原生支持基于文本、图像和视频输入组合的高质量视频生成与对话式编辑。该模型定价具有竞争力,为每秒钟视频输出 0.10 美元,与 Veo 3.1 Fast 价格相同。

Omni Flash 在以下方面表现出色:

  • 对话式视频编辑:使用自然语言对视频进行精修和编辑。
  • 多模态引用:结合图像、文本和视频等多种输入,保持对场景的控制和一致性。
  • 现实世界知识:Omni 利用 Gemini 的知识,例如历史、生物学和叙事逻辑,来构建引人入胜的视频。
  • 文本与动作同步:通过简单的提示词,将文本和图形直接与视频动作关联起来。

如需全面的基准测试信息,请访问 Google DeepMind 的 Gemini Omni 网页。

局限性:

  • Omni 目前仅支持生成 10 秒的视频,更长的时长即将推出。
  • 该模型在 Gemini API 中暂不支持上传音频参考和场景扩展功能。
  • API 架构接受时长不超过 3 秒的视频参考,但模型目前无法正确处理这些输入。
  • 在切换场景或进行平移运镜时,角色一致性存在一定局限,但我们正在努力改进。

Gemini Omni 自今日起在 Google AI Studio 和 Gemini API 中公开预览。如需查看完整的模型能力列表和特定地区的限制,请查阅开发者文档。

立即使用这两款模型进行开发

真正的魔力在于将这些模型串联起来。使用 Nano Banana 2 Lite 作为高速图像生成模型,然后将生成的图像作为参考传递给 Gemini Omni Flash,使其动画化为高质量视频。此外,通过使用 Interactions API 处理这些多轮交互体验,您可以维护会话历史和上下文,使用户能够叠加最多三次连续编辑。

为了帮助你快速上手,我们创建了几个可供你二次创作的演示应用,让你亲身体验如何将 Nano Banana 2 Lite 和 Gemini Omni Flash 整合到同一个工作流程中。

Anywhere 是一款旨在展示这两款模型强大能力的演示应用。你可以自拍或上传一张照片,该应用会利用 Nano Banana 2 Lite 瞬间将你“传送”到数十个标志性地标前。然后,当你点击生成的图片时,Omni Flash 会将该图片转化为该地点的动态视频片段。

Space Lift 是一款由 Nano Banana 2 Lite 和 Gemini Omni 驱动的室内设计演示应用,你只需上传一张照片,就能立即重新构想任何房间。该应用会自动生成涵盖多种设计美学的完整概念方案。一旦你找到心仪的风格,点击视频按钮,即可观看 Omni 以电影级展示效果将设计变为现实,让你在付诸实践之前,先动态体验你的新空间。

Omni Product Studio 是一款演示应用,它能将 Nano Banana 2 Lite 生成的静态图片,转化为由 Gemini Omni 生成的电影级电商视频。该演示展示了如何通过将多模态输入与图像到视频的输出快速交互,来构建互动式媒体内容。

跳转到位置 1 跳转到位置 2 跳转到位置 3 跳转到位置 4 跳转到位置 5 跳转到位置 6 跳转到位置 7 跳转到位置 8

以安全性和透明度为基石进行构建

Gemini Omni 和 Nano Banana 2 Lite 构建于 Google 的安全基础设施之上,并采用了 SynthID 水印技术。你可以通过 Gemini 应用、Chrome 浏览器中的 Gemini 或 Google 搜索来验证 AI 内容。进一步了解我们如何扩展验证工具,以帮助你了解网络上的内容是如何被创建和编辑的。

立即开启你的项目

Nano Banana 2 Lite 资源:

  • 前往 Google AI Studio,在 Playground 中体验该模型。
  • 深入了解我们的 Gemini API 文档。
  • 查阅我们的 Nano Banana 提示词指南,其中包含了最佳实践和示例提示词。

Gemini Omni Flash 资源:

  • 前往 Google AI Studio,在 Playground 中体验该模型。
  • 深入了解我们的 Gemini API 文档。
  • 欢迎查阅我们的 Gemini Omni Flash 提示词指南,其中包含了最佳实践和示例提示词。

发布于:

来源:Google DeepMind:Blog(RSS) · deepmind.google

同一事件 · 3

Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash

Google DeepMind:Blog(RSS)·2026-07-01 00:02·45天前·Alisa Fortin
AI 导读

Google DeepMind 推出 Nano Banana 2 Lite(gemini-3.1-flash-lite-image),为 Nano Banana 系列速度最快、成本最低的图像模型,文本到图像输出仅需 4 秒,每 1K 分辨率图像成本 $0.034,已上线 Google AI Studio、Gemini API 及消费者产品(AI Mode in Search、Gemini app 等)。同时推出 Gemini Omni Flash(gemini-omni-flash-preview),支持高画质视频生成与对话式编辑,视频输出定价 $0.10/秒,面向开发者开放 API。

正文 · AI 翻译

我们正在通过 Nano Banana 2 Lite(我们最快、最具成本效益的 Gemini 图像模型)以及 Gemini Omni Flash(用于高质量视频生成和对话式编辑)来降低实验和扩展创意的门槛。

Alisa Fortin

产品经理,Google DeepMind

Anish Nangia

产品经理,Google DeepMind

今天,我们通过两项重大发布,让您能够更快速、更轻松地实验、优化和扩展您的创意:

  • 推出 Nano Banana 2 Lite:这是 Nano Banana 系列中迄今为止最快、最具成本效益的图像模型,专为高吞吐量、高速度和大规模应用而构建。Nano Banana 2 Lite 即日起在 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 中可用。同时,它也在今天开始向 Google 消费者端产品推送,包括搜索中的 AI 模式、Gemini 应用以及众多其他产品。
  • 向开发者推出 Gemini Omni Flash:我们用于视频生成和对话式编辑的高质量、高成本效益模型,现首次在 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 中提供。Omni Flash 也已在 Gemini 应用和 Google Flow 中可用。

使用生成式媒体进行开发往往是一个创意迭代的过程。借助这两个模型,开发者可以构建全面的端到端多媒体体验,将快速图像生成与视频创建和编辑无缝衔接。无论您的工作流程是需要生成数千张图像,还是编辑多轮视频序列,您现在都拥有了两个新模型,可以更快速地构建、无缝迭代,并将您的创意愿景变为现实。

Nano Banana 2 Lite:我们最快、最具成本效益的 Gemini 图像模型

观看 Nano Banana 2 Lite 与 Nano Banana 2 在使用简单提示词时图像生成速度和质量的并排对比。

Nano Banana 2 Lite(gemini-3.1-flash-lite-image)专为快速构思和高速开发者流水线而设计,在这些场景中,速度和成本是首要约束条件。它是我们为当前使用第一版 Nano Banana(gemini-2.5-flash-image)的开发者推荐的替代模型,您现在即可进行替换,在关键性能维度上立即获得收益。

Nano Banana 2 和 2 Lite 与竞品 AI 图像模型的性能基准对比,评估了生成/编辑质量(Elo 评分)、处理延迟以及每张 1K 分辨率图像的成本之间的权衡。

Nano Banana 2 Lite 在以下方面表现出色:

  • 延迟:文本到图像输出仅需 4 秒。这使其成为交互式原型设计和快速视觉草稿绘制的理想选择。
  • 成本效益(每张 1K 图像 0.034 美元):对于专注于草稿绘制、构思、管理运营预算或低带宽使用的开发者来说,这是一个高性价比的选择。

尽管优先考虑速度,Nano Banana 2 Lite 仍保持了可靠的提示词遵循能力、强大的人物一致性以及清晰的图像内文本渲染。

了解 Nano Banana 系列

  • Nano Banana 2 Lite(Gemini 3.1 Flash Lite Image):专为速度而构建。针对超低延迟至关重要的近实时、高吞吐量工作流进行了优化。
  • Nano Banana 2(Gemini 3.1 Flash Image):通用型主力模型。以较低延迟提供高质量,实现了性能与成本的最佳平衡。
  • Nano Banana Pro(Gemini 3 Pro Image):针对复杂的专业用例进行了优化。它为准确性比速度更重要的任务提供了最强大的控制和高级推理能力。
  • Nano Banana(Gemini 2.5 Flash Image):我们的上一代模型。我们建议升级到 Nano Banana 2 Lite,以获得更好的质量、更快的速度和更低的成本。

如需查看完整的模型能力列表以及如何集成,请查阅开发者文档。

除了在开发者平台上发布外,Nano Banana 2 Lite 还将登陆 Google 的消费者产品,包括搜索中的 AI 模式、Gemini 应用、NotebookLM、Google Photos、Stitch、Google Flow 和 Google Ads。

通过 Gemini Omni Flash 体验高质量、高性价比的视频编辑与生成

观看某人使用 Gemini Omni 表演四个数字魔术,例如从手机中拉出一个 3D 气球文字,以及将屏幕中的水倒入玻璃杯。角落里的一个小“原始”视频揭示了她在添加 Omni 生成的特效之前实际拍摄这些魔术的方式。

在 Google I/O 大会上,我们推出了 Gemini Omni Flash,这是一款将 Gemini 多模态推理能力与视频生成和编辑相结合的大模型。今天,Gemini Omni Flash(gemini-omni-flash-preview)已通过 Gemini API 和 Google AI Studio 向开发者开放,原生支持基于文本、图像和视频输入组合的高质量视频生成与对话式编辑。该模型定价具有竞争力,为每秒钟视频输出 0.10 美元,与 Veo 3.1 Fast 价格相同。

Omni Flash 在以下方面表现出色:

  • 对话式视频编辑:使用自然语言对视频进行精修和编辑。
  • 多模态引用:结合图像、文本和视频等多种输入,保持对场景的控制和一致性。
  • 现实世界知识:Omni 利用 Gemini 的知识,例如历史、生物学和叙事逻辑,来构建引人入胜的视频。
  • 文本与动作同步:通过简单的提示词,将文本和图形直接与视频动作关联起来。

如需全面的基准测试信息,请访问 Google DeepMind 的 Gemini Omni 网页。

局限性:

  • Omni 目前仅支持生成 10 秒的视频,更长的时长即将推出。
  • 该模型在 Gemini API 中暂不支持上传音频参考和场景扩展功能。
  • API 架构接受时长不超过 3 秒的视频参考,但模型目前无法正确处理这些输入。
  • 在切换场景或进行平移运镜时,角色一致性存在一定局限,但我们正在努力改进。

Gemini Omni 自今日起在 Google AI Studio 和 Gemini API 中公开预览。如需查看完整的模型能力列表和特定地区的限制,请查阅开发者文档。

立即使用这两款模型进行开发

真正的魔力在于将这些模型串联起来。使用 Nano Banana 2 Lite 作为高速图像生成模型,然后将生成的图像作为参考传递给 Gemini Omni Flash,使其动画化为高质量视频。此外,通过使用 Interactions API 处理这些多轮交互体验,您可以维护会话历史和上下文,使用户能够叠加最多三次连续编辑。

为了帮助你快速上手,我们创建了几个可供你二次创作的演示应用,让你亲身体验如何将 Nano Banana 2 Lite 和 Gemini Omni Flash 整合到同一个工作流程中。

Anywhere 是一款旨在展示这两款模型强大能力的演示应用。你可以自拍或上传一张照片,该应用会利用 Nano Banana 2 Lite 瞬间将你“传送”到数十个标志性地标前。然后,当你点击生成的图片时,Omni Flash 会将该图片转化为该地点的动态视频片段。

Space Lift 是一款由 Nano Banana 2 Lite 和 Gemini Omni 驱动的室内设计演示应用,你只需上传一张照片,就能立即重新构想任何房间。该应用会自动生成涵盖多种设计美学的完整概念方案。一旦你找到心仪的风格,点击视频按钮,即可观看 Omni 以电影级展示效果将设计变为现实,让你在付诸实践之前,先动态体验你的新空间。

Omni Product Studio 是一款演示应用,它能将 Nano Banana 2 Lite 生成的静态图片,转化为由 Gemini Omni 生成的电影级电商视频。该演示展示了如何通过将多模态输入与图像到视频的输出快速交互,来构建互动式媒体内容。

跳转到位置 1 跳转到位置 2 跳转到位置 3 跳转到位置 4 跳转到位置 5 跳转到位置 6 跳转到位置 7 跳转到位置 8

以安全性和透明度为基石进行构建

Gemini Omni 和 Nano Banana 2 Lite 构建于 Google 的安全基础设施之上,并采用了 SynthID 水印技术。你可以通过 Gemini 应用、Chrome 浏览器中的 Gemini 或 Google 搜索来验证 AI 内容。进一步了解我们如何扩展验证工具,以帮助你了解网络上的内容是如何被创建和编辑的。

立即开启你的项目

Nano Banana 2 Lite 资源:

  • 前往 Google AI Studio,在 Playground 中体验该模型。
  • 深入了解我们的 Gemini API 文档。
  • 查阅我们的 Nano Banana 提示词指南,其中包含了最佳实践和示例提示词。

Gemini Omni Flash 资源:

  • 前往 Google AI Studio,在 Playground 中体验该模型。
  • 深入了解我们的 Gemini API 文档。
  • 欢迎查阅我们的 Gemini Omni Flash 提示词指南,其中包含了最佳实践和示例提示词。

发布于:

来源:Google DeepMind:Blog(RSS)· deepmind.google

同一事件 · 3