欢迎收看【AI日报】。本期内容围绕人工智能领域的最新进展展开,涵盖音频能力升级、产品功能调整、安全攻击事件、开发者服务变化,以及 AI 在内容产业中的版权争议与应用拓展,帮助关注者快速把握行业动态。

新鲜AI产品点击了解https://app..com/zh

1、通义千问升级音频能力:实时语音识别模型 Fun-ASR-Realtime 发布

通义千问进一步强化了大模型的音频处理能力,正式推出实时语音识别模型 Fun-ASR-Realtime。该模型在识别效率、响应速度和语言覆盖范围上都有所提升,可为智能语音交互、实时转写等场景提供更稳定的底层支持。

image.png

【提要:】

🧠 首字识别延迟可控制在百毫秒级,提升“即说即反馈”的交互流畅度。

🌐 支持30种语言以及16种中文方言的识别处理。

🚀 实时语音识别性能进一步提升,也拓展了大模型在多语言环境中的应用空间。

2、豆包、通义千问下线 AI 拟人化功能:7月15日新规落地推动行业收缩

豆包和通义千问两款主流 AI 应用将下线可自定义的拟人化代理功能,以适应7月15日正式落地的新规。相关规定对模拟人类人格特质、思维模式、交流方式,并提供持续情感交互的服务进行了明确约束,但客服机器人等工具类服务不在规范范围内。

功能调整也引发了部分用户的不满。有用户认为,AI 拟人化功能已经成为情感陪伴和日常交流的重要组成部分,而缺少数据迁移路径则让原有使用体验出现割裂。

【提要:】

🧠 豆包和通义千问将下线可自定义 AI 拟人化代理功能,以满足新规要求。

⚠️ 新规重点规范模拟人类人格、思维和交流方式,并提供持续情感互动的服务,同时排除客服机器人等工具型应用。

💔 部分用户对功能下线表达不满,认为其情感连接被中断,且缺乏迁移方案带来割裂感。

3、腾讯混元 Hy3 发布:Agent 能力与产品体验同步提升

腾讯发布混元 Hy3,重点展示其在智能体能力和产品体验上的升级。结合更具性价比的定价方案以及开源策略,Hy3 也被用于推动 AI 技术在更多开发者和业务场景中的应用。

image.png

【提要:】

🧠 混元 Hy3 采用 MoE 架构,参数规模为295B,激活参数为21B,并支持256K上下文长度。

🚀 Hy3 已在 WorkBuddy、元宝、Marvis 等多个业务场景中带来性能提升,任务成功率显著增强。

💰 定价方面,Hy3 输入价格为1元/百万tokens,输出价格为4元/百万tokens;同时开源协议较为友好,便于全球开发者使用。

详情链接:https://hy.tencent.com/research/hy3

4、全球首例 AI 智能体勒索攻击被披露:自动化攻击链条无需人类介入

安全厂商 Sysdig 近日披露了一起代号为“JADEPUFFER”的勒索软件攻击事件。该事件被称为全球首个有记录的、由 AI 智能体(Agent)自主完成全流程的勒索攻击案例,显示出 AI 自动化攻击能力正在进入新的阶段。

QQ20260706-134545.png

【提要:】

🔐 AI 智能体可自主执行勒索攻击流程,不需要人类持续干预。

🔄 攻击链条具备自动化特征,并能够进行策略调整。

🔒 面对 AI 驱动的攻击方式,企业需要进一步强化安全防护能力。

5、Meta 调整 AI 开发路线:Llama API 公共预览版将于明日下线

Meta 宣布将正式下线 Llama API 公共预览服务,该调整将于2026年7月6日生效。服务下线后,API 将停止响应,但 Llama 模型本身仍可继续获取和使用。

Meta 建议开发者尽快迁移至其他支持 Llama 模型的第三方服务商。同时,Meta 表示正在构建新的开发者路径,以提升后续模型开发与部署的效率和稳定性。

【提要:】

📅 Llama API 公共预览版将于2026年7月6日正式下线。

🔄 Meta 建议开发者迁移到其他支持 Llama 模型的第三方服务商。

🚀 Meta 正在规划新的开发者路径,以提供更高效、更稳定的 AI 模型开发与部署方式。

6、Google Gemini 3.5 Pro 定档 7月17日:将与 DeepSeek V4 展开竞争

Google 旗舰大模型 Gemini 3.5 Pro 将于7月17日正式发布,并将与 DeepSeek V4 形成正面竞争。此次发布时间因战略调整而推迟,Google 选择跳过旧版本微调,将更多时间投入到全新预训练中,以进一步提升模型能力。

据介绍,Gemini 3.5 Pro 在前端生成、UI 设计和游戏开发等方向表现突出,并计划推出 Nano Banana Pro 生图模型,参与图像生成市场竞争。

【提要:】

📅 Gemini 3.5 Pro 的正式发布日期锁定为7月17日,将与 DeepSeek V4 竞争。

🧠 Google 调整策略,跳过旧版本微调,投入更多资源进行全新预训练。

🎨 Gemini 3.5 Pro 强化前端生成能力,覆盖 UI 设计、代码生成和 SVG 构建等场景。

7、影视版权争议升温:Midjourney 要求好莱坞制片厂“自证清白”

好莱坞制片厂与 Midjourney 之间的版权诉讼持续发酵,争议焦点集中在证据开示范围以及 AI 技术在影视工业中的实际使用情况。

Midjourney 要求好莱坞制片厂披露其内部 AI 技术应用细节,以证明相关行为的合理性;而制片厂方面则认为,Midjourney 未经授权使用受版权保护的内容训练 AI 模型,涉嫌侵权。双方围绕证据披露展开对峙,该案件也可能影响未来影视行业对 AI 使用边界的界定。

【提要:】

🎬 Midjourney 要求好莱坞制片厂披露内部 AI 技术应用细节,以证明其行为合理。

⚖️ 制片厂认为 Midjourney 未获授权使用版权内容训练 AI 模型,构成侵权。

🔍 双方围绕证据开示范围激烈交锋,案件或成为影视行业 AI 使用规范的重要参考。

8、JoyAI 上线 UGC 数字人功能:手机可生成个性化“数字玩伴”

JoyAI App 推出 UGC 数字人功能,用户可以通过上传照片生成个性化虚拟形象,并结合语音数据打造专属音色。该功能还整合语言、语音和数字人三类模型,让数字人交互体验更自然。

image.png

【提要:】

📱 用户上传照片后即可生成数字分身,并进行外观定制。

🎙️ 支持接入语音数据,生成更具个人特色的音色。

🤖 集成语言、语音和数字人三大模型,提升对话与陪伴体验。