欢迎阅读【AI日报】。本期继续整理人工智能领域的重点进展,聚焦开发者生态、AI 产品更新和行业落地动态,帮助读者快速把握技术趋势与应用方向。
新鲜AI产品点击了解:https://app..com/zh
今日重点
本期 AI 日报重点关注 CapCut 新增两项 AI 视频创作功能、快手 AIGC 营销素材消耗规模、字节跳动开源 DeerFlow2.0,以及谷歌 DeepMind、OpenAI、蚂蚁集团、钉钉和苹果在模型、办公智能体与多模态框架方面的最新进展。
1、CapCut 上线两项 AI 功能:画布式 AI 制片工作台 Video Studio 与嵌入式 AI Video
CapCut 推出了 Video Studio 和 AI Video 两项 AI 能力,并结合 Dreamina Seedance2.0 模型,面向视频创作流程提供更高效的生成与编辑支持,进一步提升内容制作效率和成片质量。

【提要:】
🎥 Video Studio:采用无限画布式工作流,帮助简化视频创作流程。
📹 AI Video:嵌入传统编辑器,可在编辑过程中即时生成所需素材。
🎬 Dreamina Seedance2.0:依托多模态生成技术,支持高质量视频输出。
2、快手 Q4 财报显示:AIGC 营销素材单季消耗达 40 亿元,AI 正在重塑商业链路
快手 Q4 财报披露,AI 技术已经对商业收入形成了明显的直接贡献,其中 AIGC 营销素材消耗占据了重要比重。相关数据说明,AI 正在推荐、投放和素材生产等多个环节持续影响快手的商业化体系。
【提要:】
🧠 模型红利:生成式推荐大模型与智能出价模型持续优化,使国内线上营销收入提升约 5%。
🎨 内容生产力:AIGC 营销素材单季消耗达到 40 亿元,体现出广告主对 AI 内容生产的认可。
⚙️ 自动化渗透:UAX 全自动投放产品在非电商营销服务中的渗透率接近 80%。
3、字节跳动开源 DeerFlow2.0:面向复杂任务的“超级”智能体编排框架
字节跳动开源了超级智能体编排框架 DeerFlow2.0。该项目在 GitHub 上迅速获得关注,核心能力包括多维能力整合、主流生态兼容以及安全沙盒文件系统,可面向企业级复杂任务处理和个人多步骤创作需求提供支持。

【提要:】
🧠 多维能力深度整合:DeerFlow2.0 可作为集成多种能力的 SuperAgent 调度中心,支持复杂任务拆解与协作执行。
🔧 广泛兼容,即开即用:框架支持主流多模型,并可接入 MCP 协议与主流 IM 渠道,适用于企业和个人场景。
🔒 安全沙盒文件系统:提供隔离运行环境,支持代码生成、批量文件重构和结果留存等操作。
详情链接:https://github.com/bytedance/deer-flow
4、谷歌 DeepMind 发布 Lyria 3 Pro:AI 音乐生成从短乐句走向完整编曲
谷歌 DeepMind 推出 Lyria 3 Pro。该模型在音频生成能力上实现了从“短乐句”到“全曲创作”的推进,能够生成具备完整结构的歌曲,并支持高保真输出和多模态交互,显示 AI 音乐创作正逐步接近独立制作能力。
【提要:】
🎼 Lyria 3 Pro 能够编排完整歌曲结构,包括前奏、主歌、副歌和桥段。
🔊 支持 24-bit 高音质输出,可满足专业音频制作需求。
🧠 多模态交互让用户能够通过文字描述快速生成符合情绪和风格要求的音乐。
5、OpenAI 内测新模型“Spud”:拟关停 Sora 整合算力,转向桌面级“超级”应用
OpenAI 宣布,代号为“Spud”的新一代 AI 模型已经完成预训练,性能表现强劲,预计将在数周内发布。与此同时,公司正在推进战略收缩与组织调整,计划关停 Sora 以整合算力,并打造整合 ChatGPT、Codex 和 Atlas 的桌面级“超级应用”,以应对市场竞争压力。
【提要:】
🧠 新一代 AI 模型“Spud”已完成预训练,性能强大,预计很快发布。
🔄 OpenAI 正在进行战略收缩,拟关停 Sora 整合算力,并转向桌面级“超级应用”。
💼 为应对 Anthropic 挑战,OpenAI 计划打造整合 ChatGPT、Codex 和 Atlas 的统一交互中心。
6、蚂蚁集团发布 F2LLM-v2:全尺寸、多语种 Embedding 模型拿下 11 项榜单冠军
蚂蚁集团与上海交通大学联合发布 F2LLM-v2 系列 Embedding 模型。该系列在 MTEB 评测中表现突出,覆盖多种自然语言和代码场景,并以全开源方式向开发者提供可适配不同需求的模型选择。
【提要:】
🚀 F2LLM-v2 在 MTEB 评测中获得 11 项榜单冠军,展现出较强性能。
🌐 支持 282 种自然语言和 40+ 种编程语言,覆盖范围广。
🔧 提供从 80M 到 14B 的全尺寸模型家族,可适配多类应用场景。
7、钉钉悟空 AI 正式发布:面向企业场景的“数字员工”
钉钉悟空 AI 正式发布,主打企业级 AI 应用的便捷部署与安全使用。其“双击即用”的交互方式降低了企业使用 AI 的门槛,也让办公场景中的 AI 能力调用更直观。
【提要:】
🧠 悟空 AI 通过简单操作实现企业级 AI 部署,降低技术使用门槛。
🔒 强调数据安全与隐私保护,回应企业在 AI 应用中的核心顾虑。
💡 提供直观的“算粒”计数器,帮助用户了解 AI 资源消耗情况。
8、苹果发布 RubiCap 图像描述框架:小规模模型表现超越更大参数对手
苹果公司联合威斯康星大学麦迪逊分校发布 RubiCap AI 训练框架,目标是生成更精确的图像描述,并减少传统图像标注中的幻觉问题。相关模型在较小参数规模下取得了超过大型模型的表现。

【提要:】
🍎 RubiCap 面向“密集图像描述”任务设计,用于更准确捕捉图像细节。
🧠 通过强化学习机制,并利用 Qwen2.5 担任裁判来提升模型准确度。
🚀 RubiCap 模型在参数规模较小的情况下,表现超过千亿级大模型。
一句话总结
从视频创作、广告投放到智能体编排、音乐生成和企业办公,本期多项动态都显示 AI 正在更深入地进入内容生产、商业转化和工作流自动化环节。
