欢迎来到本期【AI日报】。今天的内容涵盖人工智能产业政策、视频生成与编辑模型、多语言大模型、家庭机器人以及智能助手等多个方向,便于快速掌握 AI 领域的最新进展。
新鲜AI产品点击了解:https://app..com/zh
今日重点
北京发布《人工智能产业白皮书(2025)》,预计到2025年底,北京人工智能核心产值将超过4500亿元;字节跳动推出面向视频理解与编辑的多模态大语言模型 Vidi2;快手 Kling AI 开启“Kling Omni Launch Week”,多模态视频基础模型 Kling O1 即将亮相。
1、北京发布《人工智能产业白皮书(2025)》,预计核心产值超 4500 亿元
在2025年中国人工智能大会北京举行期间,北京市科学技术委员会发布了《北京人工智能产业白皮书(2025)》。白皮书对全球及中国人工智能的发展态势进行了梳理,并指出北京人工智能产业仍在快速增长,预计到2025年底核心产值将突破4500亿元。

【提要:】
🌍 白皮书分析了全球人工智能发展趋势,并预计北京相关核心产值到2025年将超过4500亿元。
🚀 北京已成为全国人工智能企业的重要集聚地,企业数量超过2500家。
💡 依托政策引导与科研创新,北京持续推动人工智能产业高质量发展。
2、字节跳动发布“震动级”AI模型 Vidi2:120亿参数,让视频编辑彻底自动化
字节跳动推出了多模态大语言模型 Vidi2。该模型参数规模达到120亿,重点服务于视频理解任务,既能处理长视频内容,也可根据简单提示生成短视频或电影片段。Vidi2 还具备精细的时空定位能力,有助于提升视频编辑效率和准确度。

【提要:】
🎥 Vidi2 支持精细时空定位(STG),能够识别视频中的时间戳与目标对象边界框。
⚙️ 模型以 Gemma-3 作为主干网络,并结合自适应标记压缩技术,在处理长视频时兼顾效率与细节保留。
📱 基于 Vidi2 开发的工具已用于 TikTok,例如 Smart Split 功能,可实现自动剪辑、重构图和添加字幕。
详情链接:https://www.alphaxiv.org/abs/2511.19529
3、西藏首个千亿参数藏语大模型“阳光清言”问世,人工智能在高原迈入新阶段
西藏首个千亿参数藏语大模型“阳光清言”正式发布,这意味着高原地区的人工智能发展进入了新阶段,也为藏语 AI 能力建设提供了重要支撑。
【提要:】
🧠 西藏大学与创业团队联合推出“阳光清言”V1.0,参数量突破千亿,并覆盖多领域语料。
🌍 藏语 AI 基础设施取得突破,为低资源语言智能化建设提供了高原样本。
🏥 政务办事、远程医疗等场景有望实现母语交互,并提升藏语传承效率。
4、快手 Kling Omni 本周即将发布:实现“导演级”精准控制,可生成2分钟带原生音频的长视频
快手科技旗下 Kling AI 正式开启“Kling Omni Launch Week”,并将推出多模态视频基础模型 Kling O1(Omni One)。该模型支持文本、图像和视频等多输入参考,强调导演级控制能力,可生成最长2分钟的连续视频,同时实现帧级精确的音频同步,显示出 AI 视频创作正从随机生成向程序化导演模式演进。

【提要:】
🎥 Kling O1 支持文本、图像、视频多输入参考,可实现更精确的导演级控制。
⏱️ 模型可生成最长2分钟的连续视频,并强化运动稳定性与风格连贯性。
🔊 原生音频同步技术被集成其中,可让声音与画面达到帧级匹配。
5、Meta AI 推出 Matrix 框架,革新多智能体合成数据生成
Meta AI 发布 Matrix 框架,尝试通过去中心化设计缓解合成数据在新鲜性与多样性方面的问题,同时提升令牌吞吐量表现。

【提要:】
🧠 Matrix 框架采用去中心化架构,减少传统中心调度器可能带来的瓶颈。
🚀 在多项案例研究中,Matrix 实现了2到15倍的令牌吞吐量提升。
🔧 该框架利用 Ray 集群的分布式能力,支持更高效的合成数据生成与处理。
详情链接:https://arxiv.org/pdf/2511.21686
6、国产家庭机器人F1来了:连人带床把你“推”去上班,明年初售价不到两万
国产家庭机器人 F1 展示了面向家庭场景的多项能力。该机器人配备22个关节、轮式底盘和8小时续航,可执行扫地、哄娃等多类家务任务,也能完成较长序列的起床任务。F1 采用 RVLA 模型架构,任务成功率超过94%,并针对小户型空间限制进行了设计。根据计划,F1 未来还将推出教育模块,并于明年 Q1 上市。

【提要:】
🤖 F1 拥有22个关节和轮式底盘,可完成扫地、哄娃等多种家庭任务。
💡 F1 采用 RVLA 模型架构,任务成功率超过94%,遇到障碍时可自动重试。
🚀 F1 计划明年 Q1 上市,定价不到两万元,首批1000台将通过微信小程序抢购。
7、豆包升级语音功能!能说四种方言,助力老年人沟通无障碍
豆包 App 新增四种地道方言语音对话能力,进一步提升了用户与 AI 的交流体验。对于不熟悉普通话的老年用户来说,这一功能有助于降低沟通门槛。与此同时,豆包也展示了其在语音识别等技术上的持续迭代,例如通过 ASR 技术提升识别准确率,并通过奖学金活动支持科技人才培养。

【提要:】
🍊 豆包 App 新增支持粤语、四川话、东北话和陕西话四种方言的语音对话功能。
🧠 豆包语音模型具备方言迁移技术,可根据用户意图灵活切换方言。
💰 字节跳动举办奖学金颁奖典礼,将奖学金总额提升至20万元,用于支持科技人才发展。
8、豆包手机助手发布技术预览版
豆包团队正式发布豆包手机助手技术预览版,目标是为用户带来更高效的手机交互体验和更丰富的功能。该助手基于豆包大模型能力,并结合手机厂商提供的系统授权,探索新的手机使用方式。
【提要:】
🌟 豆包手机助手技术预览版今日正式发布,重点提升用户交互体验。
📱 搭载豆包手机助手的 nubia M153 工程样机已少量发售,面向开发者和感兴趣的用户。
🚀 豆包团队将继续优化助手能力,并与多家手机厂商合作,推动手机助手成熟落地。
详情链接:https://o.doubao.com/
一句话总结
从产业白皮书到视频模型、语言大模型、家庭机器人和手机助手,本期 AI 动态显示,人工智能正同时向产业规模化、内容生产自动化和日常交互智能化推进。
