欢迎收看【AI日报】。本期聚焦近期人工智能领域的多项进展,内容涵盖 AI 视频、音乐音效、具身机器人、图像生成、本地大模型、多模态工具以及 AI 著作权等方向。
新鲜 AI 产品点击了解:https://app..com/zh
今日重点
OpenAI 的 Sora 已在 Android 平台上线,网易云音乐推出了大模型音效功能“AI调音大师”,谷歌 Gemini 平台也即将发布 Nano Banana2。除此之外,字节跳动、特斯拉、微软等公司在具身智能、机器人训练和图像生成模型等方面也有新动态。
1、OpenAI Sora 正式登陆 Android,并推出“付费角色”相关新功能
OpenAI 的 AI 视频应用 Sora 已上线 Android 平台,进一步扩大了其在短视频创作领域的覆盖面。该应用已进入 Google Play 商店,同时加入“角色 Cameo”功能,主要用于应对深伪和版权相关问题,并为后续商业化探索留出空间。

【提要:】
🚀 Sora 已登陆 Android,短视频创作场景进一步扩展。
🎥 “角色 Cameo”支持用户创建可重复使用的虚拟角色。
💰 OpenAI 正围绕角色能力探索商业化方向,丰富创作者生态。
详情链接:https://play.google.com/store/apps/details?id=com.openai.sora&pli=1
2、网易云音乐上线大模型音效“AI调音大师”
网易云音乐正式推出“AI调音大师”。这一功能通过 AI 动态分析歌曲特征,并自动匹配相应音效。使用时,用户可以实时查看音效波谱,也能按照个人喜好选择不同的调音关键词,以获得更符合自身听感的播放体验。

【提要:】
✨ 依托 AI 分析歌曲特征,实现智能音效适配。
📊 用户可实时查看音效波谱,便于个性化调节。
🎧 支持“厚重”“清亮”等调音关键词,适配不同听感需求。
3、字节火山引擎启动高薪招聘,进入“人形具身机器人”赛道
字节跳动通过火山引擎团队开启高薪招聘,显示其在人形具身机器人方向已有实际动作。相关岗位要求较高,薪资水平也明显高于行业平均,说明字节跳动正在积极吸引顶尖人才,推动具身智能相关研发。
【提要:】
🔥 字节跳动启动高薪招聘,方向聚焦人形具身机器人研发。
💰 薪资达到9.5万至12万元,体现出对顶尖人才的重视。
🚀 这一布局指向具身智能赛道,并将与特斯拉、OpenAI 等科技公司形成竞争。
4、谷歌 Gemini 平台即将推出 Nano Banana2,图像生成能力继续升级
谷歌 Gemini 平台即将推出 Nano Banana2,进一步提升图像生成能力。该模型将优化视觉生成速度和艺术风格的多样性,并与 Gemini3.0 系列深度整合,以增强多模态处理表现。此外,所有生成图像都会标注水印,以保证透明度和合规性。

【提要:】
🍎 Nano Banana2 将优化视觉生成速度和艺术风格多样性,面向专业创作者需求。
🖼️ 与 Gemini3.0 系列深度整合后,多模态处理能力将进一步提升。
🔒 生成图像均会添加水印,以确保透明度与合规性。
5、llama.cpp 大幅更新,本地 AI 进入多模态应用阶段
llama.cpp 迎来重要更新,新增多模态输入、结构化输出和并行交互等能力,进一步改变了本地大模型的使用方式。其现代化 Web 界面以及多项功能升级,也让普通用户能够更轻松地搭建和使用本地 AI 工作台。
【提要:】
🖼️ 多模态能力落地,支持图片、音频、PDF 等文件解析。
💬 交互体验升级,支持并行聊天、Prompt 编辑,并对移动端更友好。
⚙️ URL 直连对话、JSON 结构化输出等功能提升了使用效率。
6、马斯克秘密实验室收集人类行为数据,用于训练 Optimus 机器人
特斯拉位于加州帕洛阿尔托的秘密实验室,正在通过大规模数据收集来训练 Optimus 机器人。数据收集者每天需要反复执行各种日常任务,以帮助机器人提升表现。尽管目前演示效果仍不理想,马斯克仍计划在年底生产5000台 Optimus 机器人。
【提要:】
🤖 特斯拉秘密实验室正在收集人类行为数据,用于训练 Optimus 机器人。
📋 数据收集者每天多次重复执行日常任务,包括擦桌子、举杯等动作。
🚀 马斯克计划到年底生产5000台 Optimus 机器人,但当前演示通常仍需远程操控。
7、上海首例 AI 著作权案宣判,“美杜莎”形象抄袭引发关注
上海首例人工智能大模型著作权侵权案已经公布判决结果。法院认定,被告李某侵犯了原告公司《斗破苍穹》中“美杜莎”角色的著作权,并判令其停止侵权、赔偿经济损失。此案也为后续 AI 创作与著作权保护提供了参考。
【提要:】
📌 被告李某利用平台功能生成与“美杜莎”角色相似的图片模型,被认定构成著作权侵权。
📌 法院认为“美杜莎”一词不具备独特商品名称保护,驳回了原告部分诉求。
📌 该判决对 AI 创作场景下的著作权保护具有参考意义。
8、微软推出首款自研 AI 图像生成器 MAI-Image-1
微软正式发布首款自主研发的 AI 图像生成器 MAI-Image-1,目前已接入 Bing 图像创作工具和 Copilot 平台。该模型在食品、自然场景以及光影效果生成方面表现突出,并在速度与质量之间取得平衡,有助于提升用户的创意生成效率。

【提要:】
🌟 微软推出首款自家开发的 AI 图像生成器 MAI-Image-1,已在 Bing 和 Copilot 中上线。
🍔 MAI-Image-1 擅长生成食品、自然场景图像,并在光影效果方面表现较好。
🔄 微软 Copilot 正逐步转向使用自家 AI 模型,以减少对 OpenAI 的依赖。
详情链接:https://www.bing.com/images/create
一句话总结
本期 AI 动态显示,AI 视频、图像生成、音乐调音、本地多模态工具和具身机器人都在同步推进,平台能力提升与商业化探索也在持续加速。
