欢迎阅读本期【AI日报】。本栏目聚焦人工智能行业的最新进展,覆盖大模型发布、开发者工具升级、AI 产品迭代以及产业应用动态,帮助读者更高效地了解关键变化。
新鲜AI产品点击了解:https://app..com/zh
今日重点
本期值得关注的消息包括:Claude Opus 4.7 正式发布、阿里巴巴开源 Qwen3.6-35B-A3B、OpenAI 为 Codex 带来新能力、Opera 推出浏览器连接器,以及 Perplexity 发布 Mac 端 AI 助手。整体来看,AI 产品正在从内容生成工具,进一步转向可调用工具、执行复杂任务并深入系统环境的智能体形态。
1、Claude Opus 4.7 发布:重点不只是更聪明,而是更可靠
Anthropic 推出 Claude Opus 4.7。本次更新将重点放在可靠性、任务执行稳定性以及输出准确性等方面。根据原文信息,Claude Opus 4.7 在多项基准测试中取得了较好表现,并在处理复杂任务时展现出更强的连续执行能力。

【提要:】
🧠 Claude Opus 4.7在编程基准测试中表现优异,超越GPT-5.4和Gemini 3.1 Pro。
💡 新增的2576像素长边识别能力提升了视觉推理表现。
🔒 4.7在任务韧性方面显著提升,能自主绕过工具链崩溃障碍。
2、阿里开源 Qwen3.6-35B-A3B:30亿激活参数带来编程能力提升
阿里巴巴千问大模型团队于2026年4月16日开源稀疏混合专家(MoE)模型 Qwen3.6-35B-A3B。该模型总参数量为350亿,运行时激活参数为30亿,编程能力较此前实现明显增强。原文提到,其表现超过270亿参数稠密模型,并具备接近更大规模模型的能力。
Qwen3.6-35B-A3B 作为全模态开源模型,在空间智能和视觉感知方面同样具备较好表现。目前,该模型已经接入 Qwen Studio,并通过阿里云百炼平台开放 API 服务。同时,它支持思维链保留功能,可适配主流 AI 编程助手。

【提要:】
🧠 Qwen3.6-35B-A3B模型以30亿激活参数实现编程能力的跨越式升级。
🚀 该模型在多项核心编程基准测试中超越了270亿参数的稠密模型。
🌐 模型已集成至Qwen Studio,并通过阿里云百炼平台提供API服务。
3、OpenAI 更新 Codex:新增 Mac 桌面操控、多智能体并行和长期任务能力
OpenAI 对 Codex 进行了一轮重要升级,带来 Mac 桌面应用操控、多智能体并行运行以及长期任务执行等新能力。此次更新还改善了浏览器体验和插件生态,使 Codex 在开发任务处理、流程衔接和多步骤工作中具备更高灵活性。

【提要:】
💻 Codex新增Mac桌面应用操控能力,可自主操作界面元素并执行任务。
🔄 支持多智能体并行运行,提升开发效率与任务处理能力。
📅 引入记忆功能,实现长期任务执行与工作流的无缝恢复。
4、Opera 推出浏览器连接器,让 AI 聊天机器人更容易接入浏览器
Opera 发布“浏览器连接器”功能,允许用户在浏览器中集成更多 AI 聊天机器人,包括 OpenAI 的 ChatGPT 和 Anthropic 的 Claude。该功能基于 MCP 协议,旨在为 AI 模型、外部数据源与搜索引擎之间建立安全的双向连接。
用户可在设置中完成安装与连接操作,从而在浏览器内更便捷地调用相关 AI 工具,提升浏览体验和使用灵活性。

【提要:】
🤖 Opera 推出浏览器连接器,允许用户在浏览器中集成更多 AI 聊天工具。
🔗 用户只需在设置中安装并连接即可使用,提升浏览体验与灵活性。
🌟 该功能适用于 Opera One 和 Opera GX,支持 ChatGPT 和 Claude 等 AI 工具。
5、英伟达发布 Lyra2.0:可由单张照片生成90米3D环境
英伟达推出 Lyra2.0 技术,可根据单张照片生成大规模且连贯性较高的虚拟环境。该技术主要用于改善长距离相机路径中容易出现的图像失真问题,也反映出 AI 在 3D 空间理解和实时环境模拟方向的持续进展。

【提要:】
🧠 通过单张照片生成90米范围的3D环境,提升AI对空间的理解能力。
🔄 引入双重创新策略,解决传统视频模型的空间失真与误差累积问题。
🚀 实现与物理引擎无缝衔接,为机器人仿真训练提供高效环境支持。
6、谷歌 Gemini 接入个人相册,推动 AI 图像生成走向个性化
谷歌 Gemini 新增接入个人相册的能力,让 AI 图像生成更贴近用户自身场景。借助 Nano Banana 工具,Gemini 可以直接调用 Google Photos 中的私人照片,减少用户手动上传素材的操作。
这一更新把个人影像资料与 AI 生成能力进一步连接起来,使生成内容更容易围绕用户已有照片和真实生活场景展开。
【提要:】
📱 谷歌Gemini接入个人相册,实现AI图像生成的个性化体验。
🎨 通过Nano Banana工具,Gemini可直接调取Google Photos中的私人相片,无需手动上传。
💡 此次更新打通了私人影像与AI生成能力之间的壁垒,推动图像生成向真正意义上的个人化发展。
7、Perplexity 推出 Mac 端 AI 助手:可全天候运行,并能代用户操作电脑
Perplexity 发布 Mac 端 AI 助手 Personal Computer。不同于传统聊天工具,这款助手不仅能理解用户指令,还可以访问文件系统和原生应用,体现出 AI 交互正在从“对话框”延伸到更深层的系统操作场景。

【提要:】
🧠 人工智能搜索领军者Perplexity发布了Mac端AI助手Personal Computer,具备直接访问文件系统和原生应用的能力。
💻 该工具支持文本与语音交互,并能实时感知用户当前的活跃窗口,主动提供操作建议。
🔒 Perplexity为助手设计了严密的防御机制,所有操作都在隔离的安全沙箱中完成,保障用户隐私。
8、拍照即录入、标签自动命名:iOS27 四项 AI 升级曝光,改变 iPhone 日常交互
苹果在 iOS 27 Beta 版本中展示了多项 Apple Intelligence 新功能,包括营养标签解析、纸面信息识别、实体卡券数字化扫描以及智能标签组命名。这些能力显示出苹果正在继续推进系统级 AI 应用,同时也为后续可穿戴设备生态提供更多基础能力。

【提要:】
🍎 营养标签解析:系统可自动扫描食品包装数据并同步至健康应用。
📄 纸面信息识别:支持从印刷品中提取电话号码或地址并一键添加至通讯录。
📱 实体卡券数字化扫描:通过AI图像识别将活动门票、会员卡等转化为数字通行证。
一句话总结
本期 AI 进展集中在模型可靠性、编程智能体、浏览器集成、3D 生成以及系统级 AI 助手等方向,显示 AI 正在更深入地进入真实任务执行和日常设备交互场景。

