欢迎查看【AI日报】。本期内容覆盖电商、语音合成、医疗大模型、视频生成、办公工具与操作系统级 AI 等多个方向,汇总人工智能领域的新产品、新功能与重要进展。

新鲜AI产品点击了解https://app..com/zh

今日重点

淘宝天猫上线 AI 假图识别模型,主要用于识别售后场景中的异常图片和恶意退款行为;百川智能发布医疗大模型 Baichuan-M3 Plus,将医学幻觉率降至 2.6%;Remotion Skills 则把自然语言指令引入程序化视频创作,进一步降低复杂视频动画的制作门槛。

1、淘宝天猫上线 AI 假图识别模型,瞄准 P 图骗保等恶意售后行为

淘宝天猫推出 AI 假图识别模型,重点应用于售后纠纷中的图片真实性判断,帮助平台和商家识别借助 P 图等方式发起的异常退款。结合物流赔付机制优化和账号诚信体系建设,这项能力正在被用于减少恶意售后造成的损失,并推动电商交易环境更加健康。

image.png

【提要:】

🛒 AI 假图识别模型已上线,可协助商家应对售后纠纷中的图片造假问题

💰 平台对异常退款行为进行拦截,已为商家挽回超过 40 亿元损失

🚚 物流赔付机制持续优化,预计全年可节约成本超 10 亿元

2、Inworld 发布 TTS-1.5,主打低延迟实时语音与多语言支持

Inworld 推出全新 TTS-1.5 语音合成模型,强调实时语音生成、低延迟与多语言能力。该模型可实现低于 250 毫秒的实时延迟,费用约为每分钟 0.005 美元,价格较市场同类产品低 25 倍。对于游戏、虚拟现实等需要自然对话体验的场景,这一更新提供了新的语音交互选择。

image.png

【提要:】

📢 TTS-1.5 模型发布,支持自然语音合成与多语言输出

💰 使用成本约为每分钟 0.005 美元,比市场同类产品便宜 25 倍

⚡ 实时延迟低于 250 毫秒,有助于提升对话交互的真实感

3、百川智能发布 Baichuan-M3 Plus,医学幻觉率降至 2.6%

百川智能推出医疗大模型 Baichuan-M3 Plus,并表示其在医学幻觉率方面实现突破,相关指标已降至 2.6%。该模型引入“六源循证范式”,旨在提升诊断建议的权威性与准确性,为医疗 AI 在真实业务中的可信应用提供支撑。

image.png

【提要:】

🧠 医疗 AI 模型 Baichuan-M3 Plus 发布,医学幻觉率降至 2.6%

📚 引入“六源循证范式”,强化诊断建议的权威性

🏥 可面向医院、互联网医疗平台及医药研发机构,提升临床使用信心

4、Remotion Skills 推出,用自然语言生成 React 视频动画

Remotion Skills 的发布,让程序化视频创作进一步走向“AI 指令驱动”。用户可以用自然语言描述需求,再由 AI 调用 Remotion 相关能力生成专业视频动画,减少手写复杂代码的工作量,同时提升视频制作和开发效率。

image.png

【提要:】

🗣️ 用户可通过自然语言指挥 AI 生成复杂 React 视频动画,减少手动编写代码的需求

🛠️ 借助 Remotion Skills 工具集,AI 智能体可深入调用 Remotion 库,实现更精细的视频控制

🚀 支持与 Claude Code 及 MCP 协议对接,简化程序化视频制作流程并降低开发成本

详情链接:https://www.remotion.dev/docs/ai/

5、苹果内部两套生成式 AI 工具曝光:Enchanté 与 Enterprise Assistant 面向员工效率场景

苹果在 2025 年 11 月上线了两套生成式 AI 工具,分别是 Enchanté 和 Enterprise Assistant,面向工程师、HR、营销、法务等内部工作场景。Enchanté 可用于代码补全、漏洞扫描和文案润色;Enterprise Assistant 则更像面向公司内部资料的搜索引擎,帮助员工快速查找文件信息并获得答案。

image.png

【提要:】

🍎 Enchanté 可通过本地或私有服务器处理运算,以保障数据安全

🔍 Enterprise Assistant 借助大语言模型,支持自然语言提问并返回带引用的答案

📊 苹果通过用户反馈持续优化模型,也为面向消费者的 AI 功能做准备

6、YouTube 计划推出“AI 个人形象”功能,Shorts 创作方式或将变化

YouTube 首席执行官尼尔·莫汉表示,平台未来将允许创作者使用自己的“个人形象”制作短视频内容。这项能力属于 YouTube 扩展创作者工具的一部分,同时平台也在继续优化内容质量管理机制,以应对低质量内容和误导性标题等问题。

【提要:】

✨ YouTube 将允许创作者使用 AI 生成的个人形象制作 Shorts 内容

🔍 平台正在优化内容质量机制,打击低质量内容和误导性标题

🖼️ Shorts 将整合图片帖等更多内容形式,改善用户浏览体验

7、微软为 Windows 11 记事本和画图加入 AI 新能力

微软在 Windows 11 的记事本与画图应用中加入了多项 AI 功能,包括 Markdown 增强、流式生成和 AI 涂色书等。相关更新表明,微软正把 AI 能力进一步下沉到操作系统的基础应用中,让常用工具具备更多智能生成与编辑能力。

【提要:】

🎨 画图新增 AI 涂色书功能,用户输入文本提示即可生成可填色线稿页面

📝 记事本扩展 Markdown 语法支持,并优化 AI 文本生成体验

🔒 所有 AI 功能需登录微软账户启用,也为未来个性化模型微调预留接口

8、苹果计划将 Siri 改造为类 ChatGPT 聊天机器人,项目代号“Campos”

苹果计划把 Siri 重塑为类似 ChatGPT 的人工智能聊天机器人,项目代号为“Campos”,并将其作为 2026 年 WWDC 开发者大会的核心亮点。新版 Siri 将支持语音与文本两种输入方式,并集成到 iOS27 及苹果全线操作系统中,同时借助 Google Gemini 模型增强性能。

【提要:】

📱 交互升级:新版 Siri 支持语音与文本双输入,界面形态更接近 ChatGPT 或 Gemini 的对话流

⚙️ 系统感知:Siri 将集成于 iOS27 及苹果全线操作系统,具备网页深度搜索、内容生成、文档分析和屏幕内容感知能力

🤝 模型合作:苹果与谷歌达成合作,Google Gemini 成为新版 Siri 及“苹果智能”的核心底层模型

一句话总结

本期 AI 动态显示,平台治理、语音交互、医疗可信度、视频创作和系统级办公助手正在同步加速,AI 正从单点工具继续走向更具体的业务流程和日常工作场景。