欢迎查看本期【AI日报】。本期内容继续聚焦人工智能行业新进展,涵盖模型发布、产品功能升级、AI 硬件、具身智能机器人以及开发者工具等方向,帮助读者快速了解近期值得关注的变化。

新鲜AI产品点击了解https://app..com/zh

今日重点

本期重点包括:阿里通义千问 Qwen 发布 Qwen-Image-Layered 分层图像编辑模型,可将普通图片拆解为类似 Photoshop 的可编辑图层;快手 Kling2.6 升级语音控制与动作控制能力,增强 AI 视频生成的可控性;谷歌推出 A2UI 开放标准,试图让 AI 代理从纯文本对话进一步走向即时图形界面交互。

1、阿里通义千问 Qwen 发布分层图像编辑模型 Qwen-Image-Layered,一键生成“Photoshop图层”

阿里通义千问 Qwen 推出了新的分层图像编辑模型 Qwen-Image-Layered。该模型能够把一张静态图片自动拆解成多个带透明背景的独立 RGBA 图层,让 AI 图像编辑从单一画面处理转向更接近 Photoshop 的分层式操作。

借助这一能力,用户可以只针对指定图层进行缩放、移动、换色等编辑,而不会明显影响画面中的其他元素。与此同时,Qwen-Image-Layered 的分层流程还可以重复执行,方便在已有拆分结果上继续细化局部内容,从而完成更精细的修改。

目前,相关模型代码已经开源,开发者和用户可通过 Hugging Face 与魔搭社区获取并进行测试。

image.png

【提要:】

📸 自动化分层:可将单层照片智能拆解为多个具备透明通道的独立 RGBA 图层,让普通图片转化为更易编辑的分层稿。

🎨 精准无损编辑:支持单独调整特定图层的大小、位置和颜色,可用于人物替换、背景改色等操作,并减少对其他画面元素的干扰。

🔓 全栈技术开源:模型代码已在 GitHub 上线,并提供在线演示,推动 AI 图像编辑向结构化、专业化方向发展。

详情链接:https://modelscope.cn/models/Qwen/Qwen-Image-Layered

2、Claude Chrome插件正式全量开放!付费用户瞬间拥有AI浏览器助手

Anthropic 宣布,Claude Chrome 扩展插件已正式向所有 Claude Pro、Team、Enterprise 付费用户开放。也就是说,相关用户不再需要排队等待或额外提交申请,即可使用这款浏览器助手。

该插件以常驻侧边栏的方式运行,并支持多标签协作,使 Claude 能更直接地参与网页浏览、内容理解和信息处理流程。与此同时,插件还新增了浏览器内代码执行与调试能力,为开发者在网页环境中编程、测试和排查问题提供了更便捷的交互入口。

【提要:】

🧠 常驻侧边栏设计,支持多标签协作。

💻 新增浏览器内代码执行与调试能力。

🚀 面向付费用户开放,以保障服务稳定性和数据安全。

3、告别僵硬AI视频!快手Kling2.6让你的声音活在AI角色里,复杂舞蹈动作也能完美复刻

快手 Kling2.6 版本更新主要围绕 AI 视频生成的可控性展开,新增语音控制和动作控制两项核心功能。通过语音控制,用户可以让声音与视频内容之间形成更准确的对应关系;通过动作控制,则能够更细致地影响人物动作表现。

这些更新有助于提升 AI 视频生成的精细度和表现力,尤其是在复杂全身动作、角色动态呈现等场景中,能够改善生成结果的自然度和可控性。原文还提到,Kling 在价格优势和市场布局方面继续强化竞争力。

image.png

【提要:】

🔊 语音控制功能可让声音与视频内容实现更精准匹配。

💃 动作控制升级,提升复杂全身动作的处理精度。

💰 价格优势与市场布局进一步增强产品竞争力。

4、AI独角兽MiniMax通过港交所上市聆讯:阿里腾讯联手押注

MiniMax 已通过港交所上市聆讯。作为一家年轻的 AI 初创公司,MiniMax 在通用人工智能方向积累了一定技术能力,并展现出市场潜力,因此持续受到资本市场关注。

根据原文信息,MiniMax 获得了阿里、腾讯等企业投资,并已搭建起相对成熟的产品矩阵。截至 2025 年 9 月,公司现金结余达到 10.46 亿美元,研发支出约为 5 亿美元。

【提要:】

🚀 MiniMax 通过港交所上市聆讯,成为最快完成 IPO 的 AI 科技公司。

💼 公司获得阿里、腾讯等巨头投资,并搭建起成熟的产品矩阵。

💰 截至 2025 年 9 月,公司现金结余为 10.46 亿美元,研发支出约 5 亿美元。

5、三星联手谷歌!全球首款Gemini AI冰箱CES前夕曝光,食材识别+红酒管家全靠AI

三星与谷歌合作推出全球首款搭载 Gemini 大模型的 AI 冰箱。该产品将大模型能力引入厨房场景,可通过 AI 视觉识别食材,并围绕日常使用提供食谱推荐、购物清单生成以及红酒管理等功能。

这一合作也反映出大模型与家电硬件进一步融合的趋势。智能家居产品正从单纯响应指令,逐步转向能够结合具体场景提供更主动服务的方向。

【提要:】

🍎 可智能识别食材,推荐食谱并生成购物清单。

🍷 支持红酒识别与品鉴,并提供配餐建议。

🤖 AI 与硬件深度结合,推动智能家居体验升级。

6、北京人形机器人推出国内首个符合国标的 VLA 大模型 XR-1

北京人形机器人创新中心开源了国内首个符合具身智能国家标准的 VLA 大模型 XR-1。该进展被视为中国智能机器人领域的一项重要突破。

XR-1 具备跨平台运行能力,可适配多种机器人平台,并执行复杂双臂操作。同时,它还结合 RoboMIND2.0、ArtVIP 等配套资源,为开发者与研究人员提供数据和工具支持,便于开展后续研究与应用探索。

image.png

【提要:】

🔥 XR-1 是国内首个符合国标的 VLA 大模型,有助于推动中国智能机器人技术发展。

🤖 支持跨平台运行,可在多类机器人平台上完成复杂操作。

📊 配套资源包括 RoboMIND2.0 和 ArtVIP,为开发者与研究人员提供支持。

7、谷歌推出A2UI开放标准:让AI代理秒变界面设计师,告别枯燥文字对话

谷歌发布 A2UI 开放标准,目标是让 AI 代理能够即时创建图形界面,从而改善以文字对话为主的传统交互模式。通过更直观的界面展示,AI 代理可以让任务处理过程更加清晰,也有助于提升用户操作效率。

A2UI 的设计重点在于传输结构化数据,而不是直接传输代码,这有助于兼顾安全性与灵活性。作为开放标准,A2UI 可应用于多种平台,并可能推动 AI 界面交互方式继续演进。

image.png

【提要:】

📅 A2UI 标准让 AI 代理能够即时生成图形界面,提升交互效率。

🔒 通过传输结构化数据而非代码,增强安全性和灵活性。

🌐 A2UI 是开放标准,适用于多种平台,有望推动 AI 界面创新。

8、AI绘画提示词新利器:PromptFill上线!

PromptFill 是一款面向 AI 绘画场景的开源结构化提示词生成工具。它采用填空式交互方式,帮助用户降低编写复杂 Prompt 的难度,让创作需求能够以更清晰的结构进行组织。

原文提到,PromptFill 支持本地隐私保护与多模板管理,适合不同经验水平的用户使用。依托开源社区参与,该工具也具备持续迭代和优化的空间。

image.png

【提要:】

🧠 填空式交互简化 Prompt 创作流程,提高 AI 绘画效率。

🔄 支持本地隐私保护与多模板管理,适合不同类型用户。

🌐 依托开源社区持续优化,助力 AI 创作工具普及。

详情链接:https://github.com/TanShilongMario/PromptFill

一句话总结

本期 AI 日报显示,人工智能正在沿着更精细的内容生成、更自然的人机交互、更深入的硬件融合以及更开放的开发生态同步推进。