本期【AI日报】聚焦人工智能领域的多个新进展,内容涵盖AI产品更新、模型开源、企业级智能体、语音模型以及Agent支付能力等方向,方便读者快速了解行业动态。
新鲜AI产品点击了解:https://app..com/zh
今日重点
小米MiMo Claw正式版发布,智谱AI开源GLM-5.2模型,微信支付推出面向Agent消费场景的“AI专属卡”。此外,微软、Anthropic、昆仑万维、OpenAI以及字节跳动相关AI业务也有新消息。
1、小米发布MiMo Claw正式版:支持千次连续工具调用,免费时长增至4小时
小米正式推出MiMo Claw正式版,面向复杂任务执行场景进一步强化了可用性。新版本支持千次连续工具调用,同时将免费使用时长提升至4小时。

【提要:】
🧠 MiMo-V2.5-Pro支持MCP工具调用协议,适合处理复杂、多步骤任务。
📊 MiMo Claw在ClawEval基准测试中的任务达标率达到63.8%,Token消耗降低40%至60%。
💰 首次订阅价格为14.9元/月,优惠订阅价格为19.9元/月或233.8元/年。
2、消息称豆包日活超2亿但收入不足百万,字节AI资源或向企业端倾斜
据消息称,字节跳动旗下AI产品豆包日活用户已超过2亿,但日收入不足百万,收入规模明显低于算力成本,目前主要依靠电商佣金获得变现。面对成本压力,字节正在调整AI战略资源分配,更多向企业服务方向倾斜,并通过Seedance等企业级业务覆盖部分成本。
【提要:】
📱 豆包日均使用用户超过2亿,但日收入不足百万。
💼 字节跳动AI资源分配出现调整,企业服务业务线权重提升。
💰 Seedance年化收入达20亿美元,月收入超过10亿元。
3、智谱AI正式开源GLM-5.2模型:主打1M无损上下文与长程代码任务
智谱AI发布并开源新一代大模型GLM-5.2,重点面向代码生成与长程任务执行。该模型在Code Arena上位列全球可用模型第二、开源模型第一,同时实现1M无损上下文能力,进一步提升长文本处理表现。GLM-5.2还加入思考档位控制,并优化底层架构,支持多端应用全链路开发。

【提要:】
🚀 GLM-5.2在Code Arena上位列全球可用模型第二、开源模型第一。
🧠 具备1M无损上下文能力,针对长文本劣化问题进行优化。
🔧 引入思考档位控制,提升编程评测表现。
4、微信支付正式发布“AI专属卡”:支持Agent闭环消费,主账户完全隔离
微信支付发布“AI专属卡”,为Agent提供闭环消费能力。该产品通过主账户隔离设计加强资金安全控制,也被视为推动AI生态从服务推荐走向消费履约闭环的重要尝试。

【提要:】
🛒 AI专属卡支持Agent闭环消费,可衔接从推荐到支付的服务链路。
🔒 主账户完全隔离,用于控制资金安全与越权消费风险。
🚀 后续将向更多Agent平台开放,推动AI生态商业化闭环升级。
5、降本近四成!微软发布Copilot Cowork智能体,正面硬刚Claude
微软推出Copilot Cowork智能体AI产品,主打企业级任务执行能力和更高性价比。该产品面向企业场景设计,在安全合规与计费灵活性方面延续Microsoft 365体系能力,并被用于对标Claude Cowork等竞品。

【提要:】
✅ 微软Copilot Cowork已在全球上线,成本比Claude Cowork低30%至40%。
🚀 产品面向企业用户,可端到端执行复杂任务,用户只需定义目标。
🔒 继承Microsoft 365信任边界,并提供灵活计费模式。
6、Anthropic紧急叫停Claude Agent SDK计费变更,重度用户暂续现有订阅限额
Anthropic暂停Claude Agent SDK计费变更,现有订阅限额暂时维持不变。此举旨在继续支持订阅用户和开发者的使用需求,也反映出大模型厂商在商业化变现、算力资源管理和开发者生态维护之间仍需权衡。

【提要:】
🤖 Anthropic暂停Claude Agent SDK计费变更,继续保持现有订阅限额。
💡 重度用户和开发者暂时仍可使用较宽松的每周标准上限。
🔄 商业化压力、算力成本与开发者生态之间的平衡仍是行业难题。
7、昆仑万维发布天工3.1:上线全新画布设计与多Agent并行工作流
昆仑万维发布天工3.1版本,带来Skywork Design和Dynamic Workflows两项核心能力。新版本强调图形化设计与多智能体协同,显示出大模型应用正从单一文本交互进一步走向复杂工作流和多Agent并行协作。

【提要:】
🎨 Skywork Design通过画布设计支持官网整站、App原型等场景的高效设计。
🤖 Dynamic Workflows支持多Agent并行工作,提高任务处理效率。
📈 天工3.1推动AI应用从文本交互向图形化工作流演进。
8、OpenAI被曝正筹备发布新一代双向语音模型“GPT-Bidi-1”
OpenAI被曝正在筹备发布新一代双向语音模型GPT-Bidi-1。该模型采用双向架构,能够在语音交互中实时捕捉用户插话和打断,并在不卡顿的情况下动态调整语义输出,从而提升实时语音对话的自然度。此外,模型还引入语音智力与速度分级,让用户可根据不同任务在交互深度和响应速度之间进行取舍。

【提要:】
🧠 GPT-Bidi-1采用双向架构,推动AI语音交互能力升级。
🔄 支持实时捕捉用户插话与打断,增强对话自然度。
📊 引入语音智力与速度分级,以适配不同任务需求。
一句话总结
本期AI动态集中在Agent能力、长上下文模型、企业级智能体和实时语音交互等方向,显示AI产品正在从单点工具加速走向可执行任务、可完成支付和可协同工作的应用形态。
