Start building with Nano Banana 2 Lite and Gemini Omni Flash
TL;DR · AI 摘要
Start building with Nano Banana 2 Lite and Gemini Omni Flash Jun 30, 2026 · Share x.com Facebook LinkedIn Mail Copy link...
核心要点
- 主题聚焦:Start building with Nano Banana 2 Lite and Gemin
- 来源:Google DeepMind Blog,建议结合原文判断细节。
- AI 分析暂不可用,本条为保底评分与摘要。
使用 Nano Banana 2 Lite 和 Gemini Omni Flash 开始构建
2026 年 6 月 30 日
·
分享
x.com
邮件
复制链接
我们正在通过 Nano Banana 2 Lite、我们最快的、成本效益最高的 Gemini 图像模型,以及用于高质量视频生成和对话编辑的 Gemini Omni Flash,让您的想法实验和扩展变得更加容易。
Alisa Fortin
Google DeepMind 产品经理
Anish Nangia
抱歉,您的浏览器不支持嵌入视频,但不用担心,您可以
下载
并使用您最喜欢的视频播放器观看!
文章正文
今天,我们通过两大发布,让您的想法实验、优化和扩展变得更加快速和便捷:
- 介绍 Nano Banana 2 Lite:目前 Nano Banana 系列中最快、成本效益最高的图像模型,专为高吞吐量、速度和规模构建。Nano Banana 2 Lite 今天已在 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 上线。它今天也已部署在 Google 消费级产品中,包括搜索中的 AI 模式、Gemini 应用和其他许多产品。
- 向开发者推出 Gemini Omni Flash:我们的高质量、成本效益高的视频生成和对话编辑模型,首次在 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 上提供。Omni Flash 同时也已在 Gemini 应用和 Google Flow 中上线。
使用生成式媒体进行构建通常涉及创意迭代。借助这两个模型,开发者可以构建全面的端到端多媒体体验,将快速图像生成与视频创作和编辑相结合。无论您的工作流程需要生成数千张图像还是编辑多轮视频序列,您现在都有两个新模型可以加速构建、无缝迭代并实现创意愿景。
Nano Banana 2 Lite:我们最快的、成本效益最高的 Gemini 图像模型
观看 Nano Banana 2 Lite 与 Nano Banana 2 在简单提示下图像生成速度和质量的并排对比。
Nano Banana 2 Lite(gemini-3.1-flash-lite-image)专为快速创意构思和对速度和成本有主要限制的高吞吐量开发者流程而设计。它是目前使用我们第一代 Nano Banana(gemini-2.5-flash-image)的开发者的推荐替代方案,您现在可以立即替换它以在关键性能维度上获得即时优势。
与竞争对手 AI 图像模型相比,Nano Banana 2 和 2 Lite 的性能基准,评估生成/编辑质量(Elo 分数)、处理延迟和每 1K 分辨率图像成本之间的权衡。
Nano Banana 2 Lite 的优势:
- 延迟:4 秒内生成文本到图像的输出。这使其非常适合交互式原型设计和快速视觉草图。
- 成本效益(每 1K 图像 0.034 美元):对于专注于草图、构思、管理运营预算或低带宽使用场景的开发者来说,这是一个成本效益高的选择。
尽管优先考虑速度,Nano Banana 2 Lite 仍保留可靠的提示遵循能力、强大的角色一致性以及清晰的图像内文本渲染。
了解 Nano Banana 系列
- Nano Banana 2 Lite(Gemini 3.1 Flash Lite Image):专为速度而建。优化用于需要超低延迟的近实时、高吞吐量工作流程。
- Nano Banana 2(Gemini 3.1 Flash Image):全能型主力模型。在较低延迟下提供高质量,提供性能和成本的最佳平衡。
- Nano Banana Pro(Gemini 3 Pro 图像):专为复杂、专业应用场景优化。它为需要精度高于速度的任务提供最稳健的控制和先进的推理能力。
- Nano Banana(Gemini 2.5 Flash 图像):我们的上一代模型。我们建议升级到 Nano Banana 2 Lite 以获得更高质量、更快的速度和更低的成本。
要查看完整的模型功能列表以及集成方式,请查看开发者文档。
除在开发者平台发布外,Nano Banana 2 Lite 还将登陆 Google 消费级产品界面,包括搜索中的 AI 模式、Gemini 应用、NotebookLM、Google 照片、Stitch、Google Flow 和 Google Ads。
通过 Gemini Omni Flash 体验高质量、高性价比的视频编辑和生成
观看视频,了解某人如何使用 Gemini Omni 完成四个数字魔术表演,例如从手机中拉出一个 3D 气球文字,或将屏幕中的水倒入玻璃杯。画面角落有一个小的“原始”视频,揭示了她如何在 Omni 生成特效之前实际拍摄这些魔术。
在 Google I/O 上,我们推出了 Gemini Omni Flash,这是 Gemini 多模态推理与视频生成和编辑结合的模型。今天,Gemini Omni Flash(gemini-omni-flash-preview)通过 Gemini API 和 Google AI Studio 向开发者开放,原生支持从文本、图像和视频输入组合中进行高质量视频生成和对话式编辑。该模型的定价具有竞争力,每秒视频输出 0.10 美元,与 Veo 3.1 Fast 相同。
Omni Flash 的优势体现在:
- 对话式视频编辑:使用自然语言精炼和编辑视频。
- 多模态引用:结合图像、文本和视频等输入,保持场景的控制和一致性。
- 现实世界知识:Omni 借助 Gemini 的知识(如历史、生物学和叙事逻辑)构建引人入胜的视频。
- 文字与动作同步:通过简单的提示,将文字和图形直接连接到视频动作。
如需全面的基准测试信息,请访问 Google DeepMind 的 Gemini Omni 网页。
限制:
- 目前 Omni 可生成 10 秒的视频,更长的时长将很快推出。
- 该模型的 Gemini API 尚不支持上传音频参考和场景扩展。
- API 架构接受最多 3 秒的视频参考,但目前模型无法正确处理。
- 在场景切换或平移运动时,角色一致性存在一定限制,但我们正在努力改进。
Gemini Omni 今天起在 Google AI Studio 和 Gemini API 中提供公开预览。要查看完整的模型功能列表和区域特定限制,请查看开发者文档。
今天即可使用这两个模型进行开发
当将这些模型串联使用时,真正的魔法才开始发生。使用 Nano Banana 2 Lite 作为高速图像生成模型,然后将该图像作为参考传递给 Gemini Omni Flash,将其动画化为高质量视频。此外,通过使用这些多轮交互体验的 Interactions API,您可以维护会话历史和上下文,使用户能够进行多达三次连续编辑。
为了帮助您入门,我们创建了几个可以重新混编的演示应用,让您亲身体验如何将 Nano Banana 2 Lite 和 Gemini Omni Flash 结合到一个工作流程中。
Anywhere 是一个演示应用,旨在展示两款模型的强大功能。你可以自拍或上传照片,应用会使用 Nano Banana 2 Lite 立即将你传送到数十个标志性地标。当点击图片时,Omni Flash 会将生成的图片转换为该地点的动画片段。
Space Lift 是一个由 Nano Banana 2 Lite 和 Gemini Omni 提供支持的演示室内设计应用,通过上传照片即可瞬间重新构想任何房间。应用会自动生成多种设计风格的完整概念方案。当你找到心仪的设计风格时,点击视频按钮即可观看 Omni 通过电影级展示将设计变为现实,让你在落地前就能体验新空间的动态效果。
Omni 产品工作室是一个演示应用,可将 Nano Banana 2 Lite 创建的静态图片转换为 Gemini Omni 创建的电影级电商视频。此演示展示了如何通过快速交互将多模态输入合并,构建交互式媒体内容。
安全透明地构建
基于 Google 的安全基础设施,Gemini Omni 和 Nano Banana 2 Lite 使用 SynthID 水印技术。你可以通过 Gemini 应用、Chrome 浏览器中的 Gemini 或搜索功能验证 AI 内容。了解更多关于如何扩展验证工具的信息,帮助你理解网络上内容的创建和编辑方式。
立即启动你的项目
Nano Banana 2 Lite 资源:
- 前往 Google AI Studio 在沙盒环境中体验该模型。
- 阅读我们的 Gemini API 文档。
- 查看我们的 Nano Banana 提示指南,其中包含最佳实践和示例提示。
Gemini Omni Flash 资源:
- 查看我们的 Gemini Omni Flash 提示指南,其中包含最佳实践和示例提示。
POSTED IN: