欢迎阅读本期【AI日报】。今天的内容主要围绕AI产品内测、开源模型、AI编程、OCR、算力框架和大模型竞争展开,便于开发者和行业关注者快速掌握人工智能领域的新动态。
新鲜AI产品点击了解:https://app..com/zh
今日重点
豆包正在灰度测试社交功能,并与飞书账号体系打通;新浪开源了轻量推理模型 VibeThinker-3B;高德地图内测“袋马”,尝试用自然语言生成应用切入AI编程场景。与此同时,百度 Unlimited OCR、昆仑芯 IPO 消息、DSpark 推理框架以及 Grok4.5 内测,也为今天的AI行业带来了新的关注点。
1、豆包内测社交功能:接入飞书账号,AI助手开始试探熟人社交
近日,有网友透露,字节跳动旗下AI助手豆包正在灰度测试社交功能,并已经正式接入飞书账号体系。这次内测中,豆包新增了独立的“对话”页面,用户可以在其中添加“豆包好友”或“飞书好友”。
【提要:】
📱 豆包新增独立“对话”页面,支持添加“豆包好友”或“飞书好友”。
👥 豆包账号可登录飞书网页版,相关信息会同步到飞书,但核心办公功能暂未开放。
🚀 行业分析认为,豆包具备成长为“超级App”的潜力,打通飞书或许是在向职场社交场景延伸。
2、新浪 VibeThinker-3B 开源:小参数模型释放出强推理能力
新浪近期开源的 VibeThinker-3B,为AI推理的“轻量化”探索提供了新的样本。这个模型参数规模只有30亿,但在数学、编程等高难度基准测试中表现亮眼,整体能力可与部分百倍规模的主流大模型相提并论,并在一些竞赛级任务中超过了多款行业顶尖产品。

【提要:】
🧠 VibeThinker-3B 通过多阶段后训练获得了较强的性能表现。
💡 相关研究提出“参数压缩-覆盖假说”,指向AI能力可能具备可压缩性。
🚀 模型开源后,可为开发者带来更轻量、更高效的工具选择,也有望推动AI行业优化训练和推理范式。
3、高德内测“袋马”:一句话分钟级生成可用应用
高德地图正在低调内测“袋马”产品,目标是通过自然语言驱动应用生成,让用户在不写代码的情况下快速创建可用程序。该产品主要面向没有研发团队的中小企业主和独立创作者,并提供对话式修改、灵感广场等功能,以降低创意落地门槛。
目前,“袋马”仍处于内测阶段,具体上线时间和商业化细则尚未公布。随着AI编程工具持续普及,应用开发门槛也在不断下降,全民应用开发的趋势进一步加快。

【提要:】
🤖 高德地图内测“袋马”,通过自然语言驱动生成应用。
💡 产品面向中小企业主和独立创作者,提供更便捷的开发工具。
🚀 AI应用生成赛道竞争升温,高德选择从小微需求切入。
4、百度开源3B模型 Unlimited OCR:5天 Star 破万,刷新长文档解析表现
百度开源的端到端OCR模型 Unlimited OCR 参数规模为3B,在长文档解析方面实现了技术突破。该模型引入 Reference Sliding Window Attention 机制,提升了处理效率和准确性,并在实际应用中体现出明显的速度优势,为文档数字化和大模型长程记忆管理提供了新的思路。
【提要:】
📚 引入 Reference Sliding Window Attention 机制,实现长文档一次性解析。
📈 在 OmniDocBench v1.6 基准测试中取得93.92%的高分。
⚡ 推理速度较 DeepSeek OCR 提升12.7%,在长输出场景下优势更明显。
5、蚂蚁阿福公布“科学减重1亿斤”进展:已累计减重10万斤
蚂蚁阿福披露了“科学减重1亿斤”项目的阶段性进展,并对不同人群、不同地区的减重情况进行了分析。相关数据也显示,科学减重并不是短期行为,更需要长期坚持。

【提要:】
🍎 蚂蚁阿福发起“科学减重1亿斤”项目,目前已有18.47万网友参与,累计减重10.26万斤。
📈 中年男性是减重主力,但年龄越大减重速度越慢,50岁以上人群人均减重仅0.38斤。
🌏 南方人减重效果更明显,华东地区减重数量最高,西北和东北地区减重较少。
6、消息称百度昆仑芯将赴港IPO,目标估值达500亿美元
据消息称,百度旗下AI芯片业务主体昆仑芯正在推进香港IPO进程,目标估值达到500亿美元。作为百度AI硬件生态中的核心板块,如果此次IPO顺利推进,将成为昆仑芯资本化过程中的重要节点,也可能为全球AI算力市场带来新的关注。
昆仑芯此前已经推出多代自研AI芯片,并在云端推理等场景中实现了大规模应用。
【提要:】
🚀 百度昆仑芯计划在香港进行IPO,目标估值达500亿美元。
🧠 昆仑芯是百度AI硬件生态的重要组成部分,涉及全球AI算力市场发展。
💡 昆仑芯已推出多代自研AI芯片,并在多种算力场景中落地应用。
7、北大与 DeepSeek 联合开源 DSpark:提升大模型推理效率
北京大学与 DeepSeek 联合推出大模型推理框架 DSpark,重点针对大模型推理中的响应延迟和算力浪费问题进行优化。该框架通过双重优化机制,提高了生成效率和吞吐量,为推理侧算力提速提供了新的工程路径。
【提要:】
🧠 采用半自回归架构,在生成效率与质量之间寻求平衡。
📊 引入置信度调度验证机制,减少无效计算。
🚀 通过工程优化实现吞吐量显著提升。
8、马斯克称每月推全新大模型:Grok4.5 内测性能比肩 Claude Opus
马斯克透露,xAI 的最新大语言模型 Grok4.5 已在 SpaceX 与特斯拉内部启动 Beta 测试。他还表示,接下来计划每月推出一个全新的基础模型,这将进一步加剧其与 OpenAI、谷歌等头部企业之间的竞争。

【提要:】
🧠 Grok4.5 基于1.5万亿参数的 V9 基础模型打造,并融入 Cursor 数据进行补充训练。
🚀 马斯克表示,Grok4.5 性能已接近甚至超越 Anthropic 旗舰模型 Claude Opus,强化学习仍在持续优化。
🚀 SpaceX 计划每月推出一个“完全从零开始训练”的全新基础模型,进一步加剧与 OpenAI、谷歌等企业的竞争。
一句话总结
本期AI日报显示,AI助手正在向社交场景延伸,轻量模型、AI编程、OCR与推理框架持续加速落地,而大模型与AI芯片赛道的竞争仍在升温。

