今日重点
本期 AI 日报关注多项模型与产品更新:阿里通义千问 3.5-Max-Preview 在 LM Arena 全球大模型公司排行榜中升至第五;豆包正在测试 AI 电商能力;腾讯 QClaw 面向用户开放公测。此外,谷歌、Canva、ElevenLabs、Cursor 和 Mistral AI 也带来了围绕桌面智能、AI 设计、音乐交易、编程模型与多模态模型的新进展。
1、中国模型登顶:阿里通义千问 3.5-Max-Preview 进入全球第五
阿里通义千问 3.5-Max-Preview 在国际大模型竞技场取得新的排名突破,以 1464 分的综合成绩跻身 LM Arena 全球大模型公司排行榜第五位,进一步展现了国产大模型在全球竞争格局中的实力。

关键信息:
🧠 数学能力排名全球第五,体现出较强的逻辑推理水平。
⚙️ 综合性能位居全球第六,在无风格控制条件下表现亮眼。
📄 专家级处理能力进入全球前十,文本处理能力受到外界关注。
2、豆包内测 AI 电商:探索“一句话下单”购物闭环
豆包正在内部测试 AI 电商功能,尝试将 AI 对话交互与电商购买流程结合,提供更直接的购物体验。这一动向也说明 AI 电商赛道的竞争正在进一步升温。

关键信息:
🛒 豆包正在内测 AI 电商能力,核心体验指向“一句话购物”。
📈 豆包月活用户达到 2.26 亿,在国内 AI 原生应用市场保持领先位置。
🔄 AI 电商竞争持续加剧,头部平台已开始推动相关能力规模化落地。
3、腾讯 QClaw 开启公测:无需邀请码,用微信远程操控 PC
腾讯 QClaw 已正式开放公测。这款 AI 助手主打通过微信远程控制 PC,可在办公、开发等场景中为用户提供辅助能力。

关键信息:
🦞 QClaw 是腾讯推出的 AI 助手,支持用户借助微信远程操控 PC,目前无需邀请码即可使用。
💻 该产品基于开源 OpenClaw 框架打造,突出“微信直连 + 零门槛部署”,并支持 Mac 和 Windows 系统。
🌐 Skills 生态覆盖文件处理、邮件生成、GitHub 自动提交等能力,面向办公与开发需求。
详情链接:https://qclaw.qq.com/
4、谷歌测试 macOS 版 Gemini 应用,或加入“桌面智能”能力
谷歌正在推进 macOS 版 Gemini 原生应用的早期 Beta 测试。该应用计划加入“桌面智能”能力,使 Gemini 能更深入地理解用户桌面应用和屏幕内容,并支持用户与 AI 进行更直接的交互。同时,应用还具备多媒体内容创建、上下文理解和网络搜索等功能。
关键信息:
🍎 谷歌已启动 macOS 版 Gemini 原生应用早期 Beta 测试,进一步扩展其 AI 生态。
🖥️ “桌面智能”功能将提升 Gemini 对桌面环境与屏幕内容的理解能力。
📷 该应用支持多媒体内容创建,并具备上下文理解和网络搜索能力。
5、Canva 计划明年 IPO,加速转向 AI 驱动设计生态
Canva 计划在明年正式启动 IPO 进程。与此同时,公司正在推动设计平台的技术升级,战略方向从传统创意工具供应商转向 AI 驱动的内容创作生态。近期,Canva 密集上线生成式 AI 功能,希望通过自动化排版、图像生成和创意协同等能力,降低个人用户和小型企业的专业设计门槛。
关键信息:
🧠 Canva 计划启动 IPO,并进入 AI 转型的关键阶段。
🤖 公司正推进平台技术革新,从传统设计工具延展至 AI 内容创作生态。
💡 生成式 AI 功能被用于降低设计门槛,同时增强平台市场竞争力。
6、ElevenLabs 推出 AI 音乐交易市场,采用“创作者分成”模式
ElevenLabs 推出 AI 音乐交易市场,将此前语音克隆的变现思路扩展到更广泛的音频内容领域,并以创作者分成模式推动 AI 内容资产化。不过,平台也明确提醒,相关内容仍存在版权法律风险,用户需要自行承担相应责任。
关键信息:
🎧 AI 音乐交易市场已上线,用户可以创作、发布并销售 AI 生成歌曲。
⚖️ 音乐授权体系分为社交媒体、付费营销和线下使用三个层级,以覆盖不同使用场景。
⚠️ 平台说明不保证生成内容具备独家性,也不提供法律保护担保。
7、Cursor 发布 Composer 2 编程模型,性能接近 GPT-5 且价格更低
Cursor 发布了自研编程大模型 Composer 2。该模型在 CursorBench 评测中取得 61.3 分,超过 Claude Opus 4.6,并接近 GPT-5.4 Thinking。Composer 2 采用相对克制的训练策略,重点强化代码处理能力,定价为每百万 Token 0.50 美元。Cursor 希望通过自研模型降低对竞争对手 API 的依赖,逐步形成从编辑器到模型底座的完整能力体系。

关键信息:
🧠 Composer 2 性能进一步提升,评测成绩超过 Claude Opus 4.6,并接近 GPT-5.4 Thinking。
💰 Composer 2 的价格为每百万 Token 0.50 美元,具备明显成本优势。
🔄 Cursor 通过自研模型强化技术底座,减少对外部 API 的依赖。
8、Mistral AI 发布 Mistral Small 4,覆盖推理、多模态与编程
Mistral AI 发布 Mistral Small 4,这是一款面向多类任务场景的大模型,覆盖推理、多模态理解和编程能力。该模型采用 MoE 架构,总参数量为 119B,激活参数为 6B,重点强调运行效率。与前代产品相比,Mistral Small 4 在性能上有明显提升,在延迟优化模式下端到端完成时间缩短 40%。

关键信息:
🧠 Mistral Small 4 同时覆盖推理、多模态理解和编程任务。
⚙️ 模型采用 MoE 架构,总参数量 119B,激活参数 6B,运行效率较高。
🚀 相比前代产品,Mistral Small 4 在延迟优化模式下端到端完成时间缩短 40%。
一句话总结
从大模型排名提升、AI 电商测试,到桌面助手、AI 设计、音乐交易和编程模型更新,本期动态显示 AI 行业正从单纯模型能力比拼,进一步走向具体产品与应用场景落地。

