发生了什么
Google Gemini 上线 Gemini Omni
为什么值得关注
除了头像视频生成外,这条还同时落地了 SynthID 验证与内容溯源能力,适合关注生成式媒体产品化和内容认证能力演进的人直接看原文。
信息来源
以下内容来自公开来源,可打开原文继续核验。
Google Gemini
Google Gemini 宣布从今天起,Gemini Omni 向所有 Google AI Plus、Pro 和 Ultra 订阅用户在网页端和移动应用全面开放,可通过 avatar 生成“看起来和听起来都像自己”的视频,且无需每次上传头像。所有 Gemini Omni 生成的视频都包含不可感知的 SynthID 数字水印,可在 Gemini 应用中验证。
打开原始来源 ↗Flow
Google DeepMind 转发了 Flow by Google 在 Google I/O 发布的更新,介绍了 Google Flow 中的 agent 和全新的 Gemini Omni model。Flow 将 agent 定位为创意协作伙伴,可在用户指导下推理复杂任务,协助头脑风暴、创作和编辑;Gemini Omni 被描述为面向视频的模型,强调世界理解、多模态和编辑能力,并可基于任意输入参考创建和编辑视频。Flow 页面同时展示了 Nano Banana、Veo 3.1 和 Gemini Omni 三个模型,其中 Veo 3.1 强调扩展创意控制、原生音频和高质量视频;Flow 还提供自然语言工具构建、图层编辑、Storyboard Studio、Shader Effects、Mockup 等功能。当前页面未给出参数量、价格或基准分数等量化数据。
打开原始来源 ↗