产品信号

Google推出Gemini Omni 1.1 Flash

Google将Gemini Omni 1.1 Flash推向全球Flow订阅用户,新增40秒场景延展、视频引用和更快的低分辨率预览,把视频生成的控制能力进一步产品化。

Google已将Gemini Omni 1.1 Flash更新推向全球Google AI Plus、Pro和Ultra订阅者的Flow用户。相较5月进入Flow的Gemini Omni Flash,新版本把视频编辑从一次性生成进一步改造成可延展、引用素材并以不同分辨率反复预览的流程产品。

编辑能力与可用范围同步扩大

Google称,Gemini Omni 1.1 Flash现可将场景延展至40秒,并允许用户引用最长3秒的视频作为编辑输入;输出可升至1080p或4K。更新不是仅限实验页面的演示:Google确认其已面向全球符合条件的Flow订阅用户开放。5月时,Gemini Omni Flash已被引入覆盖140多个国家的Flow,用于精确视频编辑;本次的变化在于把可控编辑的输入、时长和输出层级一起向前推进。

低成本预览改变创作迭代机制

视频生成的实际使用成本通常不只取决于最终成片,还取决于用户为修正镜头、动作和构图所进行的试错次数。Google表示,360p预览相较720p最高可快60%,成本约为后者三分之一。结合素材引用和场景延展,这让创作者可以先以较低成本验证修改方向,再选择更高分辨率输出。Google DeepMind报告的内部人工偏好测试及基于MovieGenBench和VBench I2V的评测,则把其对编辑质量和指令遵循的性能主张放在可说明的方法口径之下。

竞争焦点或转向编辑闭环

这次升级的核心后果,是将模型能力嵌入“生成、检查、局部调整、再输出”的创作闭环,而非只提高单条提示词的成片质量。对订阅型产品而言,更快的预览也可能提高用户可承受的迭代密度,并使分辨率分层成为服务设计的一部分。最强的反例来自Google自身模型卡:模型仍可能难以在多轮编辑中保持完全一致,复杂运动和文字渲染也仍不稳定;因此,功能扩展尚不能等同于专业视频制作中的可靠替代。

接下来关注什么

接下来可观察三类证据:Google是否公布Flow的使用频率、预览到高分辨率输出的转化或创作者留存数据;Omni 1.1 Flash是否扩展至API或企业创作工具;以及独立测评能否在多轮编辑一致性、复杂动作和文字渲染上复现其改进。若这些指标改善,编辑闭环而非单次生成将更有可能成为视频模型的主要竞争维度。

信源