Gemini Omni 1.1 Flash:视频生成更可控

Google DeepMind 推出了 Gemini Omni 1.1 Flash,为开发者带来了全新的创意控制与生成视频能力。新版本支持场景延伸,可基于长达 10 秒的上下文无缝续写视频,大幅提升了叙事连贯性。用户还能通过指定首尾帧实现平滑转场,或在 360p 分辨率下快速生成低成本预览,效率提升高达 60%。此外,模型支持将视频直接 upscale 至 4K 分辨率,并允许在输入中引用视频参考以保持一致性。这些功能现已通过 Gemini API 在 Google AI Studio 上线,助力创作者构建更专业的生成式视频工作流。
Gemini Omni 1.1 Flash 带来了全新的创意控制与生成视频能力,支持开发者构建更可控、迭代更快且适合实际部署的生成式视频。