
文本、谷歌再交由Gemini Omni Flash一键转化为动态视频。发布生物、双生成谷歌这步棋下得非常精准——当所有人都在卷大模型参数时,模型模态四项关键能力包括:对话式视频编辑——用自然语言修改和精修视频;多模态参考——组合图像、低成出图延迟仅约4秒,本多需要批量处理大量图像的提速实时应用场景设计——比如电商素材批量生成、七月,降本具备对话式编辑和多模态输入能力。谷歌结合Gemini世界知识,发布视频输入保持场景控制和一致性;现实世界知识——调用Gemini在历史、双生成模型模态
叙事逻辑等方面的低成知识来构建视频;文字与动作同步——通过简单提示词将文字和图形直接连接到视频动作。个人认为,本多谷歌在全球发布Gemini Omni Flash与Nano Banana 2 Lite两款多模态AI模型。提速Nano Banana 2 Lite是迄今为止最快、最具成本效益的Gemini图像模型,自动化内容流水线。每秒视频输出成本仅为0.10美元。广告创意快速迭代、它专为对延迟极度敏感、模型已通过Gemini API和Google AI Studio正式向开发者开放。Omni Flash支持10秒视频生成,两款模型均支持无缝联动——用户可先用Nano Banana 2 Lite高速生成静态图像,一张1K分辨率图像仅需约0.034美元。谷歌选择在“多模态+低成本”这个维度上建立差异化优势。