欢迎阅读本期【AI日报】。今天的内容主要围绕大模型、AI硬件、浏览器智能体、OCR模型和视频生成等方向展开,整理近期人工智能领域的重点产品更新与技术进展。

新鲜AI产品点击了解:https://app..com/zh

今日重点

腾讯推出新版 ima2.0,新增“任务模式”和“AI要点”等能力;微软为 Copilot 带来群聊、记忆与 Edge AI 模式更新;阿里夸克 AI 眼镜正式开启预售,并支持支付宝“看一看”支付。此外,月之暗面融资、Anthropic Claude 记忆功能、MoGA 长视频生成模型、Opera Neon 的 ODRA 以及百度 PaddleOCR-VL 也都有新动态。

1、Kimi k2性能被赞超越 GPT-5,月之暗面再获数亿美元重磅融资

国内大模型创业公司月之暗面(Moonshot AI)即将完成新一轮数亿美元融资。距离上一轮公开披露的约3亿美元融资并不算久,上一次公开信息还是在2024年8月。此次融资进展也反映出,资本市场对月之暗面的关注仍在持续升温。

【提要:】

🚀 Kimi k2模型性能被赞超越GPT-5和Claude4.5,引发全球关注。

💰 月之暗面完成数亿美元融资,资本市场对其信心高涨。

🌐 Kimi k2的发布让月之暗面再次成为全球AI舞台上的焦点。

2、Anthropic 为 Claude Pro/Max 用户推出“记忆”功能,实现个性化与安全升级

Anthropic 面向 Claude 的 Pro 和 Max 用户推出“记忆”功能,目的是让连续对话更加一致,并增强个性化体验。该功能强调隐私与隔离,用户可以自行管理记忆内容,同时还提供“隐身聊天”模式,避免相关对话数据被保存。

【提要:】

🧠 记忆功能可保存项目内容、用户偏好和工作流程信息,提升对话连贯性。

🔒 通过项目独立记忆和用户可控设计,强化隐私保护与数据隔离。

🕵️‍♂️ 新增“隐身聊天”模式,确保对话数据不被保存或显示在记录中。

3、中国科大与字节发布 MoGA 长视频生成模型:分钟级多镜头短片一键生成

中国科学技术大学与字节跳动联合发布端到端长视频生成模型。该模型采用 MoGA 算法,可生成分钟级高质量视频,被视为国产技术在全球 AI 竞争中的一项重要进展。

【提要:】

🎥 支持生成分钟级多镜头视频,突破传统短时视频生成限制。

🧠 引入 MoGA 算法,优化上下文处理能力并降低算力开销。

🚀 可面向影视、广告等场景应用,具备产业落地潜力。

详情链接:https://jiawn-creator.github.io/mixture-of-groups-attention/

4、腾讯发布全新ima2.0:任务模式上线 新增「AI要点」等功能

腾讯在 ima Open Day 活动上正式发布升级后的 ima2.0。新版引入“任务模式”,让知识库不再只是搜索问答工具,而是能够理解复杂任务、拆解步骤、调用工具并推进完整流程的智能助手。同时,ima2.0 还新增“AI要点”功能,并支持多任务并行和协作共享,以提升知识管理效率。

image.png

【提要:】

🔥 ima2.0上线“任务模式”,可对复杂任务进行自动拆解与执行。

💡 新增“AI要点”功能,帮助自动生成结构化摘要并快速提炼重点。

🤝 支持多任务并行与协作共享,提升知识库使用效率。

5、阿里夸克AI眼镜开启预售:支持支付宝“看一看”支付

阿里夸克 AI 眼镜已经开启预售。该产品支持支付宝支付,并在外观设计、佩戴体验和拍摄能力方面做了配置,面向用户的多样化使用需求。

image.png

【提要:】

📱 支持支付宝“看一看”支付,成为国内首款集成生物识别支付的智能眼镜。

👓 采用7.5mm超细镜腿与超薄镜框设计,整体重量仅42克,提升佩戴舒适度。

📸 搭载SuperRaw超级夜景模式和双重防抖系统,增强拍摄表现。

6、微软 Copilot 新增群聊、记忆与 Edge AI 模式:最多可让32人实时协作

微软为 Copilot 推出秋季重大更新,带来群聊、长期记忆以及 Edge AI 模式等功能,重点提升协作体验、个性化能力以及跨服务整合能力。

【提要:】

🌟 新增“群组”群聊功能,支持最多32人实时协作和任务分配。

🧠 加入“长期记忆”能力,可保存用户关键信息并在后续对话中调用。

🌐 Edge 浏览器推出 Copilot 模式,提供内容分析与智能建议。

7、Opera Neon 浏览器推出深度研究 Agent“ODRA”

Opera Neon 浏览器推出新的 AI 功能 Opera Deep Research Agent(ODRA),这是 Opera 在浏览器 AI 生态建设中的一项新进展。ODRA 采用并行化处理方式,能够提升复杂问题查询的效率与准确性。

image.png

【提要:】

🌍 ODRA 是 Opera 自研 AI 引擎的核心组成部分,经过两年多研发和优化,性能已有明显提升。

⚙️ ODRA 通过并行化操作,将复杂任务拆分为多个子问题,以提高研究效率。

🔍 ODRA 作为第四个 Agent 加入 Opera Neon,用户可通过全能搜索框启动研究功能。

8、百度 PaddleOCR-VL 模型登顶全球 OCR 榜,连续五日领跑 Huggingface 趋势榜

百度飞桨团队发布的 PaddleOCR-VL 模型在 OCR 领域引发关注。凭借模型性能和多语言支持能力,该模型成为当前热度较高的开源 OCR 模型之一。

QQ20251024-135355.png

【提要:】

✅ PaddleOCR-VL 在 OmniDocBench V1.5评测中取得92.56分,超过主流模型并登顶全球 OCR 榜单。

🌐 支持109种语言识别,可解析文本、表格、公式与图表,并具备文档语义结构重建能力。

🔍 百度、DeepSeek 与上海 AI Lab 等机构开源 OCR 模型,核心目标是为大模型训练提供数据基础。

一句话总结

本期 AI 日报显示,AI 产品更新正同时向任务执行、个性化记忆、多模态生成、智能硬件和数据处理能力延伸,应用落地速度继续加快。