据Android Authority报道,谷歌于8月28日对其AI创意工作室Flow进行重要更新,引入Gemini Omni 1.1 Flash模型,使AI生成视频的控制更加精确。新模型支持首帧与末帧插值,并提升了视频输出的分辨率上限至1080p和4K。

Flow最初是围绕视频生成模型Veo搭建的电影制作工具,提供摄像机运动控制和镜头扩展功能。此后,谷歌将其扩展为集图像生成与编辑于一体的AI创意工作室,并借Gemini Omni实现了文本、图像、音频和视频的组合创作。此次升级进一步强化了视频生成体验。

据Android Authority报道,Gemini Omni 1.1 Flash为Flow用户带来了多项新控制能力。在场景扩展方面,模型可分析现有视频中最多10秒的内容,而此前只能参考最后一秒。这为延续镜头提供了更多上下文,有助于保持视觉一致性和叙事连贯性。扩展可按10秒增量生成,累计最长可达40秒。

新模型还改进了视频草稿工作流,用户可以用360p分辨率快速生成草稿视频,节省积分和等待时间,之后再转为更高质量渲染。视频参考功能则帮助维持视觉语境和角色一致性,使生成结果更接近成片。

谷歌尚未公布这些功能的正式上线时间。据Android Authority报道,相关介绍显示更新已逐步推送。此次更新距离Flow上次重大功能发布不久,反映出谷歌在AI视频创作工具领域的持续迭代。