谷歌发布GeminiOmni1.1Flash,视频生成新突破,最高支持4K分辨率

谷歌DeepMind于近日正式发布了新一代视频生成模型Gemini Omni 1.1 Flash,这款面向开发者的AI工具旨在提升视频创作的效率与质量。据Google官方博客披露,新版本在多个维度实现...

人工智能

谷歌DeepMind于近日正式发布了新一代视频生成模型Gemini Omni 1.1 Flash,这款面向开发者的AI工具旨在提升视频创作的效率与质量。据Google官方博客披露,新版本在多个维度实现了技术突破,为专业视频制作提供了更强大的支持。

在核心功能方面,Gemini Omni 1.1 Flash引入了多项创新特性。首先是场景延长功能,用户可以基于已有视频内容,在结尾处无缝衔接并继续生成后续画面,每次可延长10秒,累计最长可达40秒。这一改进显著提升了视频叙事的连贯性,使AI生成的视频更接近专业水准。此外,开发者还可以通过指定起始帧与结束帧,实现平滑的镜头运镜效果,适用于环绕拍摄、缩放转场等复杂场景。

值得注意的是,新版本还增强了多模态输入能力。用户可以引用最多3秒的参考视频片段,确保生成内容在角色形象和画面上下文上保持一致。这种特性对于需要连续性和一致性的视频创作尤为重要,如影视广告或产品演示视频。

在效率优化方面,Gemini Omni 1.1 Flash推出了360p草稿模式,相较于标准720p模式,生成速度最快可提升60%,成本仅为后者的三分之一。这一特性特别适合快速原型验证、分镜脚本迭代等需要高效产出的场景。最终成片则支持1080p和4K分辨率输出,满足不同应用场景的需求。

从市场定位来看,Gemini Omni 1.1 Flash的定价策略颇具竞争力。根据官方公布的费率表,360p每秒0.03美元(约合0.2元人民币),720p每秒0.10美元(约合0.67元人民币),1080p每秒0.15美元(约合1元人民币),4K每秒0.30美元(约合2元人民币)。与竞品Veo 3.1 Lite 720p每秒0.05美元和Veo 3.1 Fast 4K每秒0.30美元的价格相比,Omni 1.1 Flash在中端分辨率上具有明显的价格优势。

目前,Gemini Omni 1.1 Flash已在Google AI Studio和Gemini Enterprise Agent Platform上线。Google AI Plus、Pro、Ultra订阅者即日起可在Google Flow中使用该模型,而场景延长功能也已开放给Gemini应用用户。此外,Adobe Firefly、Figma Weave、GMI Cloud和Runway等平台均已集成该模型,进一步扩大了其应用场景。

图片

这张图片展示了Gemini Omni 1.1 Flash生成的多种风格视频片段,从室内场景到自然风光,再到人物特写,充分体现了该模型在不同场景下的表现力。左上角是复古风格的室内场景,中间是生动的自然生态画面,下方则是更具艺术感的人物肖像,这些示例直观地展现了模型的多样化创作能力。