Google Vids接入Gemini Omni模型,上传自拍和音频即可定制专属数字分身

Google Vids引入Gemini Omni模型,用户上传自拍和音频即可生成外貌与声音高度还原的专属数字分身,无需真人出镜就能完成视频讲解。该功能进一步结合Gemini多模态能力,为AI视频创作提供更便捷的定制化体验。
Google Vids新增AI数字分身功能
尽管OpenAI的Sora或许已经逐渐淡出视野,谷歌仍判断,用户希望在AI生成视频中亲自“出镜”的需求并未减弱。本周四,谷歌为Google Vids推出一项重要更新:用户上传一张自拍照片和一段语音录音后,系统便可以生成一个在外貌与声音方面高度接近本人的专属数字虚拟人。这样一来,即使本人不在镜头前,也能借助数字分身完成视频中的表达。
Gemini Omni加入Google Vids
此次数字人功能更新的同时,谷歌还将自家的多模态模型Gemini Omni引入Google Vids。借助文字提示词和上传的参考图片,用户可以通过文字与图片的组合来生成视频内容。
Gemini Omni还提供了多项面向实际创作的编辑能力。例如,用户可以为手机拍摄的视频更换背景、调整光线并添加特效。与此同时,Google Vids新增渐进式编辑支持,创作者能够在制作过程中逐步修改内容,无需因为某个环节不满意而从头开始制作。
从办公演示工具走向视频创作平台
随着这批功能上线,Google Vids的定位正在从AI辅助办公演示工具,进一步拓展到更广泛的视频创作领域。谷歌此前已将Vids纳入Google Workspace,这也表明其希望把该产品应用于企业内部通知、培训视频等商业场景。
不过,个性化虚拟人和对话式视频编辑功能的加入,也让Google Vids与HeyGen、Synthesia、Captions、D-ID等AI视频初创公司进入了更直接的竞争关系。
虚拟人功能强调安全与合规
针对AI虚拟人可能带来的滥用风险,谷歌强调,新功能生成的虚拟人会与账户持有者的真实样貌及其Google账户进行严格绑定,并通过SynthID技术添加隐形水印。按照这一设计,用户无法利用该功能制作针对他人的恶搞或虚假换脸视频,例如伪造谷歌CEO桑达尔·皮查伊的相关内容。
目前,个人虚拟人功能仅面向特定地区的年满18岁用户开放。随着AI数字分身进入办公套件,谷歌正在尝试在提升视频制作效率的同时,为生成内容设置相应的身份限制与安全边界。
