
Google DeepMind 正式发布 Gemini Omni 1.1 Flash,这是一款面向开发者的生产级模型更新,旨在显著提升对生成式视频内容的控制力。新版模型支持场景延伸、首尾帧插值过渡、4K 超高清画质提升以及更快的原型迭代速度,以满足实际部署需求。
核心功能升级
场景延伸与叙事连贯:新增场景延伸功能允许在现有视频基础上无缝续接画面。不同于以往仅参考最后一秒,Omni 1.1 能分析长达 10 秒的前置上下文,大幅提升视觉连贯性。开发者每次可增加 10 秒时长,将视频总长度延伸至 40 秒。
首尾帧精准控制:通过指定起始帧和结束帧,模型可在两个关键帧之间生成连续视频流,实现流畅的画面过渡及复杂的运镜效果,适用于相机环绕、变焦过渡或无缝循环片段制作。
高效原型迭代:引入 360p 分辨率快速草稿模式。相比标准 720p,360p 版本生成速度最高提升 60%,成本降低至三分之一,极大便利了快速原型设计、分镜迭代及渲染测试。
4K 超高清输出:完成初步创作后,Omni 1.1 可直接生成 1080p 或 4K 高清成品视频,无需额外处理即可用于专业级影视制作。
多模态视频参考:构建场景时,开发者最多可上传三段视频作为参考素材,帮助 AI 准确理解视觉语境,确保角色外观和行为逻辑的一致性。
行业应用与接入
目前,Adobe、Figma、Runway 等行业巨头已将 Gemini Omni Flash 集成至工作流中。Adobe 将其整合进 Firefly 以增强视频编辑能力;Figma Weave 利用其上下文推理能力辅助镜头调度;Runway 则借此提升从灵感到成片的流转效率。
Gemini Omni 1.1 现已向全球 Google AI Plus、Pro 及 Ultra 订阅用户开放(涵盖 Google Flow 及 Gemini 应用)。开发者可通过 Google AI Studio 直接体验,或在 Gemini 企业级智能体平台上进行部署,官方文档、代码示例及提示词指南已同步上线。
【星途科讯 图文丨 Patrick 首发于 ZAKER 科技,转载请注明出处】


