谷歌发布旗舰多模态大模型Gemini Omni 可实现“任意输入、任意输出”能力
▪AI快讯2503个月前
今日凌晨,在谷歌2026 I/O开发者大会上,官方正式发布全新旗舰级多模态大模型Gemini Omni。据了解,Gemini Omni主打“任意输入、任意输出”的核心能力,打破传统AI模态割裂局限,实现文本、图像、音频、视频等全模态信息的互通理解与自由生成。据官方介绍,Gemini Omni依托谷歌成熟的世界模型Genie、图像模型Nano Banana、视频生成模型Veo三大核心技术底座,构建起完整的全模态AI框架。
今日凌晨,在谷歌2026 I/O开发者大会上,官方正式发布全新旗舰级多模态大模型Gemini Omni。据了解,Gemini Omni主打“任意输入、任意输出”的核心能力,打破传统AI模态割裂局限,实现文本、图像、音频、视频等全模态信息的互通理解与自由生成。据官方介绍,Gemini Omni依托谷歌成熟的世界模型Genie、图像模型Nano Banana、视频生成模型Veo三大核心技术底座,构建起完整的全模态AI框架。
来源:TechWeb
