欢迎来到本期【AI日报】。今天的内容涵盖图像生成、语音识别、AI 输入法、科普动画、AI 广告以及办公智能体等多个方向,便于开发者和 AI 爱好者快速了解行业最新进展。

新鲜AI产品点击了解https://app..com/zh

今日重点

OpenAI 被曝正在测试下一代图像生成模型,Qwen-Image-i2L 将单张图片生成可训练 LoRA 的门槛进一步降低,智谱 AI 也同步推出桌面端输入法并开源语音识别模型,通用 AI 助手“灵光”则上线了科普动画生成功能。

1、OpenAI 下一代图像生成模型疑似现身,已在 Design Arena 与 LM Arena 开启盲测

OpenAI 近期被曝正在小范围盲测两款新的图像生成模型,代号分别为“Chestnut”和“Hazelnut”。从目前披露的信息来看,这两款模型主要面向文本到图像生成场景,在世界知识理解、画面真实感以及代码内容渲染等方面都有明显提升。

image.png

【提要:】

🧠 新模型在世界知识理解能力上,已基本接近谷歌最新Nano Banana Pro 的水平。

📷 新模型能够生成更接近摄影级真实感的名人风格自拍,面部细节、五官比例和光影处理均较 gpt-image-1 有大幅进步。

💻 在图像内呈现可读代码方面,新模型表现突出,可较准确地渲染复杂代码片段、流程图标签和数学公式。

2、一张图秒变AI风格神器!Qwen-Image-i2L颠覆图像生成,零门槛LoRA训练来袭

Qwen-Image-i2L 进一步简化了“单张图片生成可微调 LoRA 模型”的流程。用户只需输入任意一张图片,系统就能提取其中的风格、内容、构图、色调等关键视觉信息,并生成一个体积较小的 LoRA 模块,从而降低个性化风格迁移和图像生成微调的使用门槛。

文章还提到,Qwen-Image-i2L 提供四种专属模型风格,可适配不同生成场景。与此同时,这类高效训练方式也需要留意潜在的过拟合问题。

image.png

【提要:】

🖼️ 核心创新在于从单图生成 LoRA,一键开启个性化图像生成。

🎨 四款模型变体面向多元场景,便于用户按需求选择。

🚀 技术路线强调高效率,但仍需警惕过拟合等潜在挑战。

详情链接:https://modelscope.cn/models/DiffSynth-Studio/Qwen-Image-i2L/summary

3、智谱 AI 输入法全新发布,语音识别技术同步开源!

智谱 AI 发布了 GLM-ASR 系列语音识别模型,并同步开源相关技术,目标是提升语音交互体验。与此同时,智谱 AI 还推出桌面端输入法,支持语音转文字、翻译、文本改写等能力,让用户在 PC 场景中也能更便捷地使用语音输入和智能文本处理。

据介绍,新用户可获得 2000 积分,并享有 28 天免费使用时间。

【提要:】

🌟 GLM-ASR 系列模型发布,涵盖云端语音识别模型和端侧模型,强调识别精度表现。

🛠️ 智谱 AI 输入法面向桌面端上线,提供语音转文字、翻译和改写等功能。

🎁 新用户可免费领取 2000 积分,获得最长 28 天使用权。

详情链接:https://huggingface.co/zai-org/GLM-ASR-Nano-2512

4、灵光上线新能力:一键生成科普动画,复杂原理可视化呈现

通用 AI 助手“灵光”上线了科普动画生成功能,可通过更直观的动画方式解释复杂科学原理。该功能覆盖多个科学与工程相关领域,能够把抽象概念转化为动态演示,帮助用户更容易理解相关知识。

目前,这项能力已经融入灵光的对话功能中,用户在交流过程中即可触发并获取动态解释。

image.png

【提要:】

🧪 通用AI助手“灵光”新增科普动画生成能力,可将抽象科学原理以可视化方式呈现。

🌍 灵光可自动生成模拟动画,辅助用户理解天文学、物理学等领域的复杂概念。

🔄 该功能已接入对话流程,用户可即时触发并查看动态解释。

5、麦当劳 AI 生成的圣诞广告因嘲讽声潮而被撤回

麦当劳荷兰分公司此前推出一支由 AI 生成的圣诞广告,但由于内容带有反传统倾向、视觉效果也不理想,遭到网友批评,最终该广告被撤回。尽管制作方表示项目投入了不少时间和人力,公众反馈仍以负面评价为主。

【提要:】

🌟 麦当劳荷兰分公司发布 AI 生成圣诞广告后,因反传统观点和视觉效果问题遭批评并撤回。

🎬 广告中快速切换的场景和怪异角色引发观众不满,画面质量也受到质疑。

💼 制作公司曾为广告进行辩护,称项目投入大量人力,但未能扭转负面反响。

6、马斯克的 xAI 推出新工具,可在电影中实时植入 AI 广告

马斯克旗下 xAI 推出名为 Halftime 的新工具,可将 AI 生成广告实时植入电影和电视剧内容中,让广告与剧情场景结合。根据介绍,该工具甚至可以在角色对话中插入产品展示,使广告看起来像叙事的一部分。

这一能力也引发外界讨论,焦点集中在电影艺术完整性、版权边界以及观众体验等问题上。

【提要:】

🌟 Halftime 可将 AI 生成广告实时植入电影和电视剧。

🎥 工具能够在角色对话中插入产品展示,尝试让广告融入剧情。

📜 相关争议集中在电影艺术完整性可能受到影响等问题上。

7、阿里组建千问C端事业群:整合夸克、UC,挑战超级APP地位

阿里巴巴集团宣布成立“千问C端事业群”,整合原智能信息与智能互联两大事业群的核心资源,其中包括夸克、UC 等核心应用。阿里希望将“千问”打造成 AI 时代的超级APP,并成为用户数字生活的第一入口。

除移动端应用外,千问还计划延伸至眼镜、PC、汽车等多终端场景,进一步构建覆盖更多使用场景的 AI 网络,以提升用户体验并增强阿里在 AI 时代的竞争力。

【提要:】

🚀 阿里成立千问C端事业群,整合夸克、UC等核心应用资源。

📱 目标是打造AI时代的超级APP,成为用户数字生活的第一入口。

🌐 计划拓展至眼镜、PC、汽车等多终端场景,构建更广泛的AI网络。

8、微软 Excel 网页版全新 “智能体模式” 上线,AI 助力高效数据处理

微软为网页版 Excel 推出了全新的“智能体模式”,让 AI 更深入地参与复杂数据处理任务。该模式可帮助用户提升表格处理效率,并通过展示决策过程和推理逻辑增强透明度。

image.png

【提要:】

🧠 智能体模式让 Excel 更接近智能数字助手,提升数据处理效率。

📊 AI 可参与复杂工作流程,并实时更新表格数据。

🔍 用户可审查 AI 的决策过程和推理逻辑,从而获得更高透明度。

一句话总结

本期 AI 日报的主线集中在“更低门槛的生成能力”和“更深入的办公、交互场景落地”:图像、语音、动画和表格处理都在被 AI 工具持续重塑。