欢迎阅读本期【AI日报】。今天的内容主要围绕大模型、AI硬件、浏览器智能体、OCR模型和视频生成等方向展开,整理近期人工智能领域的重点产品更新与技术进展。
新鲜AI产品点击了解:https://app..com/zh
今日重点
腾讯推出新版 ima2.0,新增“任务模式”和“AI要点”等能力;微软为 Copilot 带来群聊、记忆与 Edge AI 模式更新;阿里夸克 AI 眼镜正式开启预售,并支持支付宝“看一看”支付。此外,月之暗面融资、Anthropic Claude 记忆功能、MoGA 长视频生成模型、Opera Neon 的 ODRA 以及百度 PaddleOCR-VL 也都有新动态。
1、Kimi k2性能被赞超越 GPT-5,月之暗面再获数亿美元重磅融资
国内大模型创业公司月之暗面(Moonshot AI)即将完成新一轮数亿美元融资。距离上一轮公开披露的约3亿美元融资并不算久,上一次公开信息还是在2024年8月。此次融资进展也反映出,资本市场对月之暗面的关注仍在持续升温。
【提要:】
🚀 Kimi k2模型性能被赞超越GPT-5和Claude4.5,引发全球关注。
💰 月之暗面完成数亿美元融资,资本市场对其信心高涨。
🌐 Kimi k2的发布让月之暗面再次成为全球AI舞台上的焦点。
2、Anthropic 为 Claude Pro/Max 用户推出“记忆”功能,实现个性化与安全升级
Anthropic 面向 Claude 的 Pro 和 Max 用户推出“记忆”功能,目的是让连续对话更加一致,并增强个性化体验。该功能强调隐私与隔离,用户可以自行管理记忆内容,同时还提供“隐身聊天”模式,避免相关对话数据被保存。
【提要:】
🧠 记忆功能可保存项目内容、用户偏好和工作流程信息,提升对话连贯性。
🔒 通过项目独立记忆和用户可控设计,强化隐私保护与数据隔离。
🕵️♂️ 新增“隐身聊天”模式,确保对话数据不被保存或显示在记录中。
3、中国科大与字节发布 MoGA 长视频生成模型:分钟级多镜头短片一键生成
中国科学技术大学与字节跳动联合发布端到端长视频生成模型。该模型采用 MoGA 算法,可生成分钟级高质量视频,被视为国产技术在全球 AI 竞争中的一项重要进展。
【提要:】
🎥 支持生成分钟级多镜头视频,突破传统短时视频生成限制。
🧠 引入 MoGA 算法,优化上下文处理能力并降低算力开销。
🚀 可面向影视、广告等场景应用,具备产业落地潜力。
详情链接:https://jiawn-creator.github.io/mixture-of-groups-attention/
4、腾讯发布全新ima2.0:任务模式上线 新增「AI要点」等功能
腾讯在 ima Open Day 活动上正式发布升级后的 ima2.0。新版引入“任务模式”,让知识库不再只是搜索问答工具,而是能够理解复杂任务、拆解步骤、调用工具并推进完整流程的智能助手。同时,ima2.0 还新增“AI要点”功能,并支持多任务并行和协作共享,以提升知识管理效率。

【提要:】
🔥 ima2.0上线“任务模式”,可对复杂任务进行自动拆解与执行。
💡 新增“AI要点”功能,帮助自动生成结构化摘要并快速提炼重点。
🤝 支持多任务并行与协作共享,提升知识库使用效率。
5、阿里夸克AI眼镜开启预售:支持支付宝“看一看”支付
阿里夸克 AI 眼镜已经开启预售。该产品支持支付宝支付,并在外观设计、佩戴体验和拍摄能力方面做了配置,面向用户的多样化使用需求。

【提要:】
📱 支持支付宝“看一看”支付,成为国内首款集成生物识别支付的智能眼镜。
👓 采用7.5mm超细镜腿与超薄镜框设计,整体重量仅42克,提升佩戴舒适度。
📸 搭载SuperRaw超级夜景模式和双重防抖系统,增强拍摄表现。
6、微软 Copilot 新增群聊、记忆与 Edge AI 模式:最多可让32人实时协作
微软为 Copilot 推出秋季重大更新,带来群聊、长期记忆以及 Edge AI 模式等功能,重点提升协作体验、个性化能力以及跨服务整合能力。
【提要:】
🌟 新增“群组”群聊功能,支持最多32人实时协作和任务分配。
🧠 加入“长期记忆”能力,可保存用户关键信息并在后续对话中调用。
🌐 Edge 浏览器推出 Copilot 模式,提供内容分析与智能建议。
7、Opera Neon 浏览器推出深度研究 Agent“ODRA”
Opera Neon 浏览器推出新的 AI 功能 Opera Deep Research Agent(ODRA),这是 Opera 在浏览器 AI 生态建设中的一项新进展。ODRA 采用并行化处理方式,能够提升复杂问题查询的效率与准确性。

【提要:】
🌍 ODRA 是 Opera 自研 AI 引擎的核心组成部分,经过两年多研发和优化,性能已有明显提升。
⚙️ ODRA 通过并行化操作,将复杂任务拆分为多个子问题,以提高研究效率。
🔍 ODRA 作为第四个 Agent 加入 Opera Neon,用户可通过全能搜索框启动研究功能。
8、百度 PaddleOCR-VL 模型登顶全球 OCR 榜,连续五日领跑 Huggingface 趋势榜
百度飞桨团队发布的 PaddleOCR-VL 模型在 OCR 领域引发关注。凭借模型性能和多语言支持能力,该模型成为当前热度较高的开源 OCR 模型之一。

【提要:】
✅ PaddleOCR-VL 在 OmniDocBench V1.5评测中取得92.56分,超过主流模型并登顶全球 OCR 榜单。
🌐 支持109种语言识别,可解析文本、表格、公式与图表,并具备文档语义结构重建能力。
🔍 百度、DeepSeek 与上海 AI Lab 等机构开源 OCR 模型,核心目标是为大模型训练提供数据基础。
一句话总结
本期 AI 日报显示,AI 产品更新正同时向任务执行、个性化记忆、多模态生成、智能硬件和数据处理能力延伸,应用落地速度继续加快。
