欢迎阅读本期【AI日报】。本栏目聚焦人工智能行业的最新进展,覆盖大模型发布、开发者工具升级、AI 产品迭代以及产业应用动态,帮助读者更高效地了解关键变化。

新鲜AI产品点击了解https://app..com/zh

今日重点

本期值得关注的消息包括:Claude Opus 4.7 正式发布、阿里巴巴开源 Qwen3.6-35B-A3B、OpenAI 为 Codex 带来新能力、Opera 推出浏览器连接器,以及 Perplexity 发布 Mac 端 AI 助手。整体来看,AI 产品正在从内容生成工具,进一步转向可调用工具、执行复杂任务并深入系统环境的智能体形态。

1、Claude Opus 4.7 发布:重点不只是更聪明,而是更可靠

Anthropic 推出 Claude Opus 4.7。本次更新将重点放在可靠性、任务执行稳定性以及输出准确性等方面。根据原文信息,Claude Opus 4.7 在多项基准测试中取得了较好表现,并在处理复杂任务时展现出更强的连续执行能力。

image.png

【提要:】

🧠 Claude Opus 4.7在编程基准测试中表现优异,超越GPT-5.4和Gemini 3.1 Pro。

💡 新增的2576像素长边识别能力提升了视觉推理表现。

🔒 4.7在任务韧性方面显著提升,能自主绕过工具链崩溃障碍。

2、阿里开源 Qwen3.6-35B-A3B:30亿激活参数带来编程能力提升

阿里巴巴千问大模型团队于2026年4月16日开源稀疏混合专家(MoE)模型 Qwen3.6-35B-A3B。该模型总参数量为350亿,运行时激活参数为30亿,编程能力较此前实现明显增强。原文提到,其表现超过270亿参数稠密模型,并具备接近更大规模模型的能力。

Qwen3.6-35B-A3B 作为全模态开源模型,在空间智能和视觉感知方面同样具备较好表现。目前,该模型已经接入 Qwen Studio,并通过阿里云百炼平台开放 API 服务。同时,它支持思维链保留功能,可适配主流 AI 编程助手。

image.png

【提要:】

🧠 Qwen3.6-35B-A3B模型以30亿激活参数实现编程能力的跨越式升级。

🚀 该模型在多项核心编程基准测试中超越了270亿参数的稠密模型。

🌐 模型已集成至Qwen Studio,并通过阿里云百炼平台提供API服务。

3、OpenAI 更新 Codex:新增 Mac 桌面操控、多智能体并行和长期任务能力

OpenAI 对 Codex 进行了一轮重要升级,带来 Mac 桌面应用操控、多智能体并行运行以及长期任务执行等新能力。此次更新还改善了浏览器体验和插件生态,使 Codex 在开发任务处理、流程衔接和多步骤工作中具备更高灵活性。

image.png

【提要:】

💻 Codex新增Mac桌面应用操控能力,可自主操作界面元素并执行任务。

🔄 支持多智能体并行运行,提升开发效率与任务处理能力。

📅 引入记忆功能,实现长期任务执行与工作流的无缝恢复。

4、Opera 推出浏览器连接器,让 AI 聊天机器人更容易接入浏览器

Opera 发布“浏览器连接器”功能,允许用户在浏览器中集成更多 AI 聊天机器人,包括 OpenAI 的 ChatGPT 和 Anthropic 的 Claude。该功能基于 MCP 协议,旨在为 AI 模型、外部数据源与搜索引擎之间建立安全的双向连接。

用户可在设置中完成安装与连接操作,从而在浏览器内更便捷地调用相关 AI 工具,提升浏览体验和使用灵活性。

image.png

【提要:】

🤖 Opera 推出浏览器连接器,允许用户在浏览器中集成更多 AI 聊天工具。

🔗 用户只需在设置中安装并连接即可使用,提升浏览体验与灵活性。

🌟 该功能适用于 Opera One 和 Opera GX,支持 ChatGPT 和 Claude 等 AI 工具。

5、英伟达发布 Lyra2.0:可由单张照片生成90米3D环境

英伟达推出 Lyra2.0 技术,可根据单张照片生成大规模且连贯性较高的虚拟环境。该技术主要用于改善长距离相机路径中容易出现的图像失真问题,也反映出 AI 在 3D 空间理解和实时环境模拟方向的持续进展。

image.png

【提要:】

🧠 通过单张照片生成90米范围的3D环境,提升AI对空间的理解能力。

🔄 引入双重创新策略,解决传统视频模型的空间失真与误差累积问题。

🚀 实现与物理引擎无缝衔接,为机器人仿真训练提供高效环境支持。

6、谷歌 Gemini 接入个人相册,推动 AI 图像生成走向个性化

谷歌 Gemini 新增接入个人相册的能力,让 AI 图像生成更贴近用户自身场景。借助 Nano Banana 工具,Gemini 可以直接调用 Google Photos 中的私人照片,减少用户手动上传素材的操作。

这一更新把个人影像资料与 AI 生成能力进一步连接起来,使生成内容更容易围绕用户已有照片和真实生活场景展开。

【提要:】

📱 谷歌Gemini接入个人相册,实现AI图像生成的个性化体验。

🎨 通过Nano Banana工具,Gemini可直接调取Google Photos中的私人相片,无需手动上传。

💡 此次更新打通了私人影像与AI生成能力之间的壁垒,推动图像生成向真正意义上的个人化发展。

7、Perplexity 推出 Mac 端 AI 助手:可全天候运行,并能代用户操作电脑

Perplexity 发布 Mac 端 AI 助手 Personal Computer。不同于传统聊天工具,这款助手不仅能理解用户指令,还可以访问文件系统和原生应用,体现出 AI 交互正在从“对话框”延伸到更深层的系统操作场景。

image.png

【提要:】

🧠 人工智能搜索领军者Perplexity发布了Mac端AI助手Personal Computer,具备直接访问文件系统和原生应用的能力。

💻 该工具支持文本与语音交互,并能实时感知用户当前的活跃窗口,主动提供操作建议。

🔒 Perplexity为助手设计了严密的防御机制,所有操作都在隔离的安全沙箱中完成,保障用户隐私。

8、拍照即录入、标签自动命名:iOS27 四项 AI 升级曝光,改变 iPhone 日常交互

苹果在 iOS 27 Beta 版本中展示了多项 Apple Intelligence 新功能,包括营养标签解析、纸面信息识别、实体卡券数字化扫描以及智能标签组命名。这些能力显示出苹果正在继续推进系统级 AI 应用,同时也为后续可穿戴设备生态提供更多基础能力。

image.png

【提要:】

🍎 营养标签解析:系统可自动扫描食品包装数据并同步至健康应用。

📄 纸面信息识别:支持从印刷品中提取电话号码或地址并一键添加至通讯录。

📱 实体卡券数字化扫描:通过AI图像识别将活动门票、会员卡等转化为数字通行证。

一句话总结

本期 AI 进展集中在模型可靠性、编程智能体、浏览器集成、3D 生成以及系统级 AI 助手等方向,显示 AI 正在更深入地进入真实任务执行和日常设备交互场景。