谷歌可能会在I/O 2026上展示新的视频生成模型Omni
31
hardware
谷歌推出新模型 Gemini Omni——文本生成视频
最近在封闭演示中出现了谷歌的 Gemini Omni 新版本。它已经展示了令人印象深刻的效果:用户可以创建短视频,在聊天窗口直接编辑,并使用现成模板。
核心功能
* 视频混音——模型能够组合已有视频并添加新元素。
* 对话内编辑——所有更改都在聊天中完成,无需切换到单独的编辑器。
* 模板——预设脚本可快速生成内容。
在 Gemini 应用内部,元数据表明 Omni 是 Veo 平台的扩展。目前尚不清楚它将在谷歌整体生态系统中占据什么位置。
测试视频
1. 讲桌上的教授——AI 生成了一个场景,其中教师写下数学证明,并正确显示公式和解释顺序。
2. 两名男子在海边吃意大利面——第二个场景相当逼真,但包含典型的生成模型伪影。
两项测试均使用 AI Pro 方案账户日限额的 86%。
产品状态
该模型尚未向公众开放。然而谷歌已确认其对视频生成的承诺,尤其是在竞争对手停止支持 Sora 后。预计公司将在 Google I/O 2026 大会上公布关于 Gemini Omni 和其他生成媒体创新的更详细信息,该会议通常是平台关键更新的发布场所。
评论 (0)
分享你的想法——请保持礼貌并围绕主题。
登录后发表评论