阿里通义实验室发布 Wan-Streamer v0.2 模型,AI 视频电话响应延迟仅 550ms
▪AI快讯901个月前

阿里通义实验室发布 Wan-Streamer v0.2 模型,实现端到端响应延迟仅 550 毫秒,让 AI 能边听边看边回应。该模型将“听、看、说、演”统一进单个 Transformer,支持全双工交互,输出分辨率大幅提升,应用场景包括视频通话助手、沉浸式游戏 NPC 等。 #AI #人工智能 #实时交互
阿里通义实验室发布 Wan-Streamer v0.2 模型,实现端到端响应延迟仅 550 毫秒,让 AI 能边听边看边回应。该模型将“听、看、说、演”统一进单个 Transformer,支持全双工交互,输出分辨率大幅提升,应用场景包括视频通话助手、沉浸式游戏 NPC 等。 #AI #人工智能 #实时交互
来源:IT之家
