Gemini Omni 1.1 Flash 降低视频成本并增强控制

The Decoder··作者 Matthias Bastian

关键信息

场景延展现在会分析最长 10 秒的现有视频,而不只是最后 1 秒,并且可以按 10 秒为单位延展,最长到 40 秒。开发者还可以上传最多 3 秒的外部素材作为风格参考;据称 360p 草稿模式最高可快 60%,成本只有 720p 的三分之一,生成结果还能放大到 1080p 或 4K。

资讯摘要

谷歌将 Gemini Omni Flash 视频模型更新到了 1.1 版本,重点放在更低成本的生成和更直接的创作控制上。最重要的变化之一是场景延展能力提升:模型现在会分析最长 10 秒的现有视频,而不再只是最后 1 秒,这有助于在延展片段时保持画面连续性。开发者可以按 10 秒为单位延展场景,最长可扩展到 40 秒。此次更新还加入了风格参考功能,用户可以上传最多 3 秒的外部素材,让生成的视频继承角色外观或运动模式。

除此之外,Gemini Omni 1.1 Flash 还支持设置起始帧和结束帧,从而在关键帧之间生成镜头运动。谷歌表示,新的 360p 草稿模式最高可快 60%,成本只有 720p 的三分之一。生成后的视频还可以继续放大到 1080p 或 4K,具体取决于所需质量。该模型已通过 Google AI Studio 和开发者文档提供,面向构建视频生成工作流的开发者。

Gemini Omni 1.1 Flash 降低视频成本并增强控制

资讯正文

谷歌的 Gemini Omni 1.1 Flash 让 AI 视频生成更便宜,也更灵活

谷歌将其 Gemini Omni Flash 视频模型更新至 1.1 版本。场景扩展现在会分析最长 10 秒的现有视频,而不再只是最后 1 秒,以获得更一致的视觉效果。场景可以以 10 秒为单位延长,最长可达 40 秒。开发者还可以上传最多 3 秒的外部素材作为风格参考,以沿用人物角色或运动模式,并设置起始帧和结束帧,在关键帧之间创建镜头运动。

来源与参考

  1. 原始链接
  2. Google's Gemini Omni 1.1 Flash makes AI video generation cheaper and more flexible

收录于 2026-08-28