本期 AI 日报聚焦多项重要进展:AI 图像生成与编辑工具迎来升级,阿里巴巴推出万亿参数级语言模型,AI 眼镜支付场景进一步落地,微软智能体强化学习模型受到关注,同时上海也发布了面向 AI 广告产业的扶持政策。

新鲜 AI 产品可点击了解:https://app..com/zh

1、即梦图片4.0发布:覆盖文生图、图像编辑与组图生成

即梦图片4.0已正式上线,新版本将文生图、图片编辑、组图生成等能力进一步整合,为内容创作者提供更完整的 AI 图像创作与处理流程。此次升级重点强化了指令理解、精准编辑和特征保持等能力,在生成速度、画面质量以及编辑可控性方面带来新的提升。


image.png

【提要:】

🖼️ 文生图能力在效率和画质上均有提升,最快可在1.8秒内生成2K分辨率图像,并支持4K输出。

🖌️ 图像编辑支持通过文字描述完成增加、删除、修改、替换等操作,降低复杂修图门槛。

🎨 组图生成可一次产出多张具有关联性的图片,适用于设计方案、视觉概念和故事板快速搭建。

2、阿里巴巴发布 Qwen3-Max-Preview:参数规模超过一万亿

阿里巴巴推出了 Qwen3-Max-Preview,这是一款参数规模超过一万亿的语言模型。相比此前的顶级模型 Qwen3-235B-A22B-2507,新模型在知识理解、对话能力、任务处理和指令执行等方面均有明显增强,同时进一步降低知识幻觉,提升回答内容的准确性。

在上下文能力方面,Qwen3-Max-Preview 最高支持258,048个输入令牌,最多可生成32,768个输出令牌。价格方面,每百万输入令牌为2,151美元,每百万输出令牌为8,602美元。目前该模型暂不支持图像处理功能。


image.png

【提要:】

🌟 Qwen3-Max-Preview 是阿里巴巴最新发布的语言模型,参数规模超过一万亿。

💬 模型在知识理解、对话表现、任务处理和指令遵循方面优于上一代模型。

💰 定价为每百万输入令牌2,151美元、每百万输出令牌8,602美元,当前不支持图像处理。

详情链接:https://chat.qwen.ai/

3、小米AI眼镜上线支付宝“看一下支付”

小米AI眼镜正式接入支付宝“看一下支付”功能。用户可通过语音指令完成扫码支付,让智能眼镜在支付场景中的使用更加便捷。该功能由小米与支付宝联合打造,并结合支付宝多维度风控体系,为交易安全提供保障。


image.png

【提要:】

✨ 小米AI眼镜已支持支付宝“看一下支付”,提升可穿戴设备的支付便利性。

🔒 支付宝多维风控系统参与保障交易安全。

🚀 支付能力正在成为智能眼镜的重要应用之一,推动 AI 眼镜场景继续拓展。

4、微软14B参数模型挑战671B巨型AI

微软研究院开源的 rStar2-Agent 模型依托智能体强化学习技术,在 AI 数学推理方向取得突破。该模型以相对较小的参数规模实现了较强性能,并在相关测试中超过参数量更大的模型,体现出高效训练方法和智能体交互机制的潜力。

【提要:】

🧠 rStar2-Agent 通过智能体交互机制进行自主推理和代码验证,有助于减少错误累积。

🚀 在数学基准测试中,rStar2-Agent 表现超过参数规模更大的 DeepSeek-R1,显示出更高效率。

🔧 该模型采用 GRPO-RoC 算法应对环境噪声,改善训练效果,并在多个任务中取得突出表现。

详情链接:https://github.com/microsoft/rStar

5、MiniMax启动期权增发计划

MiniMax启动新一轮期权增发,面向全序列核心贡献员工提供激励。此次覆盖范围包括算法、工程、产品、市场、增长以及职能等岗位,表明公司不仅重视技术研发团队,也认可业务、市场和运营等不同方向的贡献。

【提要:】

🌟 MiniMax启动期权增发计划,用于激励全序列核心员工。

💡 覆盖算法、工程、产品、市场、增长和职能等多个岗位序列。

🚀 通过期权激励吸引和留住关键人才,为后续发展提供支撑。

6、微软推出 AI Agent 模型 rStar2-Agent

微软推出的新型 AI Agent 模型 rStar2-Agent 持续受到关注。该模型参数量仅为140亿,却在多个基准测试中取得优异成绩,甚至超过更大规模模型。其训练方法与基础设施设计,也让外界重新思考模型性能与参数规模之间的关系。


image.png

【提要:】

🧠 rStar2-Agent 仅有140亿参数,但在数学推理测试中达到80.6%的准确率,超过6710亿参数的 DeepSeek-R1。

🔧 微软从基础设施、算法和训练流程等方面进行优化,支撑模型实现高效训练与稳定表现。

📊 rStar2-Agent 在科学推理和工具使用任务中同样表现良好,展现出一定泛化能力。

详情链接:https://github.com/microsoft/rStar

7、谷歌公布 Gemini 使用限制

谷歌在最新帮助中心文章中明确了 Gemini 的使用限制,使不同账户类型对应的权益更加清晰。免费用户每天最多可使用五次提示,Pro 用户和 Ultra 用户每日提示次数上限分别为100次和500次。此外,免费用户在深度研究报告和图像生成数量方面也存在相应限制。

【提要:】

🌟 Gemini 免费用户每日最多可使用五次提示。

📊 Pro 用户每日最多可使用100次提示,Ultra 用户每日最多可使用500次提示。

🔍 升级账户后,可获得更多生成图像和研究报告等权益。

8、上海发布AI广告扶持政策:大模型补贴最高500万元

上海市近日发布《上海市支持人工智能赋能广告业创新发展的若干措施》,通过多项扶持举措推动人工智能技术在广告行业中的应用落地。政策重点覆盖大模型私有化部署补贴、语料研发与应用补贴,以及算力租用支持,旨在降低企业技术研发和部署成本,促进广告行业数字化、智能化转型。

【提要:】

🧠 大模型私有化部署补贴: 对采用第三方大模型进行私有化部署,并应用于广告垂类领域的数字广告企业,上海市将按最高核定合同额50%,给予最高500万元补贴。

📚 语料研发与应用补贴: 鼓励企业购买非关联方语料,用于广告垂类应用和“智能体”等研发,相关投入可按最高核定合同额30%,获得最高500万元补贴。

💻 算力租用支持: 有条件的区政府还将支持租用算力的数字广告企业,按实际投入30%的比例,给予单个主体年度最高2000万元支持。

一句话总结

本期 AI 日报的核心看点集中在图像生成工具升级、大模型能力提升、智能硬件支付场景落地,以及地方政策对 AI 广告产业的扶持加码。