
Google DeepMind 发布 Nano Banana 2 Lite 与 Gemini Omni Flash 两款模型。前者是家族中最快、最省成本的图像模型,约 4 秒出图、每千张 0.034 美元;后者支持视频生成与对话式编辑,每秒 0.10 美元。两者同属 Gemini 生态,可在同一套 API 下完成图像到视频的开发链路。
生成式媒体的开发工作流长期存在一个断层:图像生成模型负责快速出图,视频模型负责动态内容,两者之间往往需要开发者自己搭桥。Google DeepMind 近期发布的两款模型——Nano Banana 2 Lite 与 Gemini Omni Flash——正是冲着这个断层去的。前者把图像生成的速度和成本压到新低,后者则把视频生成与对话式编辑整合进同一套 API 体系。两者的组合意味着,一个团队可以在同一条流水线上完成从快速原型到多轮视频精修的全部环节。
对于正在选型图像与视频生成能力的开发者而言,这次更新的核心信号不是「又多了一个模型」,而是「图像与视频之间的切换成本被显著降低」。
Nano Banana 2 Lite 的模型标识为 gemini-3.1-flash-lite-image,属于 Gemini 3.1 系列中的轻量图像分支。它的设计目标非常明确:面向高吞吐、低延迟、成本敏感的开发者管道。如果你的场景是批量草稿、交互式原型、或者需要在预算内跑完大量图像任务,这个模型就是为这类需求准备的。
Google DeepMind 方面将其定位为初代 Nano Banana(gemini-2.5-flash-image)的推荐替代品。对于仍在使用旧版模型的团队来说,直接切换即可在多个性能维度上获得改善,无需重构调用逻辑。
从官方披露的基准数据看,Nano Banana 2 Lite 最突出的两个数字是:
值得注意的是,速度优先并不意味着质量妥协。该模型在提示词遵循、角色一致性和图像内文字渲染方面仍保持了可用的可靠性。这意味着它不仅能出图,还能出「能用的图」。
理解这款模型,需要把它放回整个家族的分工中:
| 模型 | 定位 | 适用场景 |
|---|---|---|
| Nano Banana 2 Lite | 速度优先 | 近实时、高并发、超低延迟场景 |
| Nano Banana 2 | 通用主力 | 质量与成本平衡的日常任务 |
| Nano Banana Pro | 专业复杂 | 需要强控制与高级推理的高精度任务 |
| Nano Banana(初代) | 遗留模型 | 建议升级至 2 Lite |
这种分层策略实际上是在告诉开发者:不要用一个模型解决所有问题,而是根据任务的延迟敏感度和质量要求来选型。
除了 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 等开发者入口,Nano Banana 2 Lite 也同步进入 Google 的消费级产品面,包括搜索中的 AI Mode、Gemini 应用、NotebookLM、Google Photos、Stitch、Google Flow 和 Google Ads。这种「开发者与消费者同步」的节奏,说明 Google DeepMind 希望模型能力尽快在真实用户场景中得到验证和反馈。
Gemini Omni Flash 最早在 Google I/O 上亮相,当时强调的是「Gemini 的多模态推理与视频生成编辑相结合」。如今它以 gemini-omni-flash-preview 的标识通过 Gemini API 和 Google AI Studio 向开发者开放,原生支持从文本、图像、视频的组合输入中生成高质量视频并进行对话式编辑。
定价方面,该模型为每秒视频输出 0.10 美元,与 Veo 3.1 Fast 持平。这意味它在价格带上直接对标已有的快速视频模型,但在编辑交互方式上引入了对话式能力。
任何新模型都有边界,Omni Flash 目前公开的限制包括:
这些限制意味着,Omni Flash 当前更适合短片段、对话式精修和快速概念验证,而非长视频的完整制作。
如果把视线拉回国内,图像与视频生成模型的「轻量化 + 链路整合」趋势同样明显。字节跳动的豆包系列在图像生成上持续迭代,强调中文提示词理解与本土审美适配;快手可灵在视频生成领域较早开放了 API 能力,支持图生视频和多轮编辑;阿里通义万相则在电商素材、营销视频等场景中积累了较多工程化经验。
与 Google DeepMind 此次发布的思路相比,国内厂商的一个差异在于更强调垂直场景的打包能力,比如直接面向电商、广告、短剧生产提供端到端方案,而不只是提供底层模型 API。另一个差异是价格策略:国内平台的图像生成单价普遍更低,部分甚至以免费额度吸引开发者,这与 Nano Banana 2 Lite 每千张 0.034 美元的定价形成对照。对于面向国内市场的团队来说,选型时需要在模型能力、中文适配、合规要求和综合成本之间做权衡,而非简单套用海外基准。
如果你正在评估是否接入这两款模型,可以从以下角度切入:
更多模型能力与集成方式可参考 Google AI for Developers 官方文档,视频模型的基准信息可查阅 Google DeepMind 的 Gemini Omni 页面。关于 Gemini 系列模型的整体演进,Wikipedia 的 Gemini 条目 提供了背景梳理。
Nano Banana 2 Lite 以速度和成本为第一优先级,文本到图像约 4 秒、每千张约 0.034 美元,适合高吞吐草稿和交互式原型;Nano Banana 2 是通用主力模型,在质量与成本之间取得平衡,适合日常生产任务。
目前支持 10 秒视频生成,更长时长尚未开放。此外,Gemini API 暂不支持音频参考上传和场景扩展,3 秒以内的视频参考虽被 schema 接受但模型尚无法正确处理。
开发者可通过 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 使用。Nano Banana 2 Lite 还进入了搜索 AI Mode、Gemini 应用、NotebookLM、Google Photos 等消费级产品;Gemini Omni Flash 也在 Gemini 应用和 Google Flow 中可用。
如果面向海外用户、需要与 Gemini 生态深度集成,这两款模型有链路优势;如果面向国内市场、重视中文适配、合规与成本,豆包、可灵、通义万相等国内方案在垂直场景打包和价格上可能更合适。
Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。
编辑团队:内容策划 · 技术编辑 · AI 研究组
网站:bingdada.com
© 2026 Bingdada. 保留所有权利。
Поместите бренд в ленту читателя
Рекламные места внутри статей — моменты высокого внимания, идеальны для запуска продуктов и набора на мероприятия.
SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

Google DeepMind 在欧洲启动为期三个月的机器人加速器,支持 15 家具身智能初创企业,覆盖工业、医疗、建筑与海洋等场景,释放出物理 AI 从研究走向工程化落地的明确信号。

Google DeepMind 为 Gemini 系列引入智能体视频理解,模型可自主决定看哪些片段、以何种帧率与模态检索,token 消耗最多降 88%、成本最多降 66%,准确率最高提升 7%。

Google DeepMind 六周内第三次更新 Flash 系列,推出 Gemini 3.8 Flash 与 3.8 Flash Cyber,分别瞄准长周期智能体编程与网络安全防御,性能逼近高成本前沿模型而价格不变。
Получайте свежие материалы по SEO и GEO.
Мы уважаем вашу конфиденциальность. Отписаться можно в любой момент.
Войдите, чтобы присоединиться к обсуждению