欢迎查看本期【AI日报】。本期聚焦人工智能行业的新产品发布、模型更新与产业应用进展,内容覆盖 AI 浏览器、语音生成模型、开源权重模型、创意生产工具、品牌整合以及智能制造等多个方向。
新鲜AI产品点击了解:https://app..com/zh
今日重点
美团旗下光年之外的 Tabbit 浏览器已启动公测,产品重点放在通过多模型 AI Agent 实现网页任务自动执行;阿里通义实验室发布两款语音生成模型,支持以自然语言指令进行 FreeStyle 控制;Notion 则接入首个开源权重模型 MiniMax M2.5,进一步丰富其 AI 工作流中的模型选择。
1、美团旗下光年之外 Tabbit 浏览器开启公测:集成多模型 AI Agent,支持全自动化网页执行
Tabbit 浏览器目前已正式进入公测阶段。与传统浏览器主要承担信息访问入口不同,Tabbit 更强调任务执行能力,试图把浏览器升级为面向个人办公与生产力场景的智能中枢。
通过内置多模型 AI Agent,Tabbit 能够在网页环境中完成自动化操作,包括跨系统数据流转、表单填写等任务,为 AI 在日常办公中的应用提供了新的产品形态。

【提要:】
🧠 内置多模型 AI Agent,可完成网页自动化操作。
🔄 支持跨系统的数据流转,并可自动填写表单。
💡 提供“妙招(Skill)”与“脚本(Script)”能力,帮助用户提升处理任务的效率。
2、一句话即可“调教”音色!阿里通义发布语音双模型:支持 FreeStyle 自然语言控制
阿里通义实验室推出两款语音生成模型,核心亮点在于用户可以用自然语言指令控制音色、表达方式以及音频场景。相比传统参数式调节,这种方式更直观,也更适合语音内容创作流程。
新模型面向语音生成与音频制作场景,目标是在提升生成效率的同时,增强声音表现力与音频质量,让用户能够更便捷地完成声音风格设定和复杂音频场景构建。

【提要:】
🎙️ Fun-CosyVoice3.5 支持多语种语音生成与更细致的控制,提升语音表达的自然度和准确性。
🎧 Fun-AudioGen-VD 可依据描述生成“人物 + 场景”一体化音频,增强环境氛围和沉浸感。
💡 两款模型均支持“FreeStyle”指令,用户可用自然语言控制声音风格或构建复杂音频场景。
3、打破闭源垄断!Notion 引入首个开源权重模型 MiniMax M2.5:联手“国产之光”重塑 AI 工作流,主打“极致性价比”
Notion 已将 MiniMax M2.5 纳入其 AI 能力体系,这是 Notion 引入的首个开源权重模型。此举意味着 Notion 的 AI 模型选择不再局限于闭源模型,也为用户带来了更具性价比的替代方案。
MiniMax M2.5 在性能和推理速度方面表现突出,并针对真实办公场景做了优化,与 Notion“全能工作台”的产品定位较为契合。对于依赖 Notion 进行知识管理、协作和工作流搭建的用户而言,模型选择的扩展有助于提升任务适配灵活性。
这一动作也与 Notion 在 2026 年强调的“模型不可知论”战略相呼应:用户可以根据不同任务的特点切换模型,从而进一步强化 Notion 作为个人与企业数字大脑的定位。
【提要:】
🧠 MiniMax M2.5 作为首个开源权重模型进入 Notion,为用户增加了更高性价比的选择。
🚀 MiniMax M2.5 在性能与推理速度上表现优秀,甚至超过部分闭源旗舰模型。
🔄 Notion 引入开源模型,体现其“模型不可知论”思路,使用户可按任务场景自由切换模型。
4、创意一站式打通!谷歌升级 Flow AI 工具:视频、绘画与特效全融合
谷歌对 Flow AI 工具进行了大规模功能扩展,将图像生成技术 Whisk 与 ImageFX 整合进同一工作环境。升级后,创作者可以在 Flow 中完成从图片生成、素材处理到动画和特效制作的连续流程。
随着图像、视频与动态效果能力进一步打通,Flow 的定位也更接近一站式 AI 创意工作室,能够帮助用户减少在多个工具之间切换的成本。

【提要:】
✨ 统一工作流:用户可在同一界面中完成图片生成到动画制作的流程。
🖼️ ImageFX 驱动:借助谷歌最新 DALL-E 级别图像模型生成高质量素材。
🎨 动态化编辑:动画制作能力得到加强,支持更细致的动作流向与特效表现。
5、阿里巴巴大模型品牌正式更名为“千问”,实现品牌矩阵全面整合
阿里巴巴宣布将 AI 业务核心品牌统一为“千问”,这代表其大模型相关品牌矩阵进入整合阶段,也显示出阿里在 AI 战略上的进一步聚焦。
千问大模型在技术与市场层面均保持较强表现,其开源模型在全球开发者社区中活跃度位居前列;与此同时,千问 APP 的用户活跃度也出现明显增长,呈现出向国民级 AI 助手发展的趋势。
【提要:】
🧠 千问大模型技术表现突出,多款模型包揽 Hugging Face 全球开源大模型榜单前四名。
📱 千问 APP 用户活跃度提升,春节期间日活跃用户达到 7352 万,增幅为 940%。
🌐 阿里巴巴通过品牌整合强化其在开源生态与 C 端市场的影响力,推动国产大模型向全球顶尖水平靠拢。
6、三星宣布 2030 年迈向“AI 工厂”,Agentic AI 成为核心大脑
三星宣布,计划在 2030 年前把其全球生产体系升级为“AI 工厂”。这一制造体系将以 Agentic AI 作为核心驱动力,目标是在原材料到成品的全流程中实现更高水平的自治化。
在该规划中,AI 不仅参与生产调度和流程优化,还将与数字孪生、机器人等技术结合,推动制造环节向更高效率、更高一致性和更安全的方向演进。
【提要:】
🧠 AI 工厂将覆盖生产全流程自治,提升制造效率与产品一致性。
🔄 数字孪生技术将用于虚拟工厂和实体产线之间的实时同步。
🤖 高风险作业将交由结合数字孪生技术的环境安全机器人完成。
7、OpenAI 疑似收购 GPT.com 顶级域名,目前已跳转至 ChatGPT 官网
OpenAI 疑似已完成对顶级域名 GPT.com 的收购。目前访问该域名时,页面会跳转至 ChatGPT 官网,这一处理方式与此前 Chat.com 被收购后的跳转逻辑较为相似。
这一动作被外界视为 OpenAI 对核心品牌资产的防御性保护,同时也体现出其围绕生成式 AI 生态入口进行长期布局,持续强化用户对 ChatGPT 与 GPT 品牌的认知。
【提要:】
✅ OpenAI 疑似收购 GPT.com 域名,进一步加强品牌护城河。
🔄 GPT.com 当前已跳转至 ChatGPT 官网,与此前 Chat.com 的处理方式一致。
🌐 OpenAI 通过战略性域名布局构建全生态入口,继续加深用户对品牌的认知。
8、攻克长视频检索难题!北京大学联手 OceanBase 打造 LoVR 基准:入选 WWW 2026,开启“全视频+片段级”智能检索新范式
北京大学与 OceanBase 共同打造的 LoVR 基准,推动长视频多模态检索评测进入新的阶段。该基准面向长视频中更复杂的语义关联问题,重点解决传统短视频检索方法在长视频场景中适配不足的问题。
LoVR 同时覆盖全视频检索和片段级检索,可为未来的视频搜索引擎、AI 剪辑助手等应用提供更可靠的评测基础,也有助于推动长视频理解能力的进一步提升。
【提要:】
🎥 全粒度覆盖:同时支持全视频检索和片段级检索,适配多样化需求。
📊 规模化高质量标注:借助大模型自动生成数据,实现更低成本、可扩展的数据构建。
🧠 真实场景建模:更准确刻画长视频检索中的难点,提升评测的有效性。
一句话总结
本期 AI 行业动态表明,AI Agent、语音生成、开源模型和多模态创意工具正在更深入地进入实际工作流,同时企业也在围绕品牌资产、流量入口和生产体系持续推进 AI 化升级。
