欢迎阅读本期【AI日报】。这里持续整理人工智能领域的最新进展,覆盖大模型、AI产品、开发者工具与行业应用,方便读者快速掌握技术走向和产品变化。

新鲜AI产品点击了解https://app..com/zh

今日重点

本期看点包括:腾讯开源混元图像2.1,支持原生2K分辨率和高质量文字生成;爱诗科技完成6000万美元B轮融资,由阿里巴巴领投;Freepik接入豆包Seedream 4.0图像模型,Premium+和Pro会员可获得无限图片生成能力。此外,阿里通义千问、微软、Fellou、清华团队和Claude也在模型、浏览器、3D数字人与办公自动化等方向带来新进展。

1、腾讯开源混元生图模型 HunyuanImage2.1,支持写字与 2K 分辨率

腾讯混元推出最新图像生成模型“混元图像2.1(HunyuanImage2.1)”。该模型支持原生 2K 分辨率图像生成,进一步增强了复杂语义理解和跨领域泛化能力,同时兼容中英文输入,并具备较强的高质量文本生成能力。当前模型已在 Hugging Face 和 GitHub 开源,可为视觉创作者提供更高效的生成工具,也为后续多模态图像生成研究提供基础。

image.png

【提要:】

🌟 支持原生 2K 分辨率,有助于提升图像生成质量与创作效率。

🖌️ 强化复杂语义理解能力,并支持较高质量的文字生成。

🔧 开源版本已上线,开发者可用于研究和二次开发。

详情链接:https://hunyuan.tencent.com/image

2、爱诗科技完成 6000 万美元 B 轮融资,阿里巴巴领投

爱诗科技在 AI 视频生成方向继续推进产品与商业化布局。公司已完成 6000 万美元 B 轮融资,由阿里巴巴领投;同时,其自研视频生成大模型 PixVerse V5 在图生视频领域表现领先,用户规模也已突破 1 亿。爱诗科技还计划推出开放平台 API,以推动视频生成技术在更多场景中更大规模落地。

【提要:】

🌟 爱诗科技完成 6000 万美元 B 轮融资,由阿里巴巴领投。

🎥 自研视频生成大模型 PixVerse V5 在图生视频领域排名第一,用户规模突破 1 亿。

🌐 公司计划推出开放平台 API,帮助视频生成技术更广泛地进入创作场景。

3、Freepik 接入豆包 Seedream 4.0 图像模型,Premium+ 会员可无限使用图片生成

Freepik 已上线豆包 Seedream 4.0 图像模型,为设计师和创作者提供新的图像生成选项。该模型支持生成 2K 和 4K 高分辨率图片,并提供多种纵横比,便于适配不同设计需求。Freepik 的 Premium+ 和 Pro 会员可享受无限图像生成权益;与此同时,火山引擎也已上线 Seedream 4.0 API,便于开展大规模图像处理。


image.png

【提要:】

🌟 Seedream 4.0 支持生成 2K 和 4K 高分辨率图像,提升输出质量。

💼 Premium+ 和 Pro 会员可获得无限图像生成权益。

📈 火山引擎上线 Seedream 4.0 API,便于大规模图像处理。

4、800 亿参数只用 30 亿!阿里千问 3 新模型推理速度提升 10 倍

阿里巴巴通义千问团队发布 Qwen3-Next-80B-A3B-Instruct 模型。该模型采用 MoE 专家混合架构,在保持模型能力的同时,降低了计算成本和资源消耗。据介绍,其推理速度相比 Qwen3-32B 提升至 10 倍以上,尤其在长上下文处理方面更具效率,为 AI 开发者提供了更低成本的模型选择。

222.jpg

【提要:】

🧠 采用 MoE 专家混合架构,兼顾高效推理与较低资源消耗。

⚡ 推理速度提升至 Qwen3-32B 的 10 倍以上,长上下文处理效率更高。

💰 训练成本明显下降,有助于更多机构参与大模型开发。

5、微软推进 AI 供应商多元化,将在 Office 365 中集成 Anthropic 技术

微软开始将 Anthropic 的 AI 技术引入 Office 365,这也被视为其 AI 供应商策略调整的一部分。相关合作主要基于技术表现考量,并非谈判策略。此举表明微软正在推动 AI 供应链多元化,同时继续加强自身 AI 技术研发,以降低对单一外部供应商的依赖。

【提要:】

🧠 微软将 Anthropic 的 AI 技术整合进 Office 365,以提升相关功能表现。

🤝 微软与 Anthropic 的合作主要基于技术性能考量。

🚀 微软也在推进 AI 技术自主研发,减少对外部供应商的依赖。

6、首款 AI Agent 浏览器 Fellou CE 发布,主打“无缝衔接”体验

Fellou CE 正式发布,这是一款面向复杂任务执行的自主 AI 浏览器。它通过自然语言交互,帮助用户完成工作流程中的多步骤任务,目标在于提升效率并增强创造力。Fellou 同时表示,将持续建设开放的智能生态系统,并重视用户隐私与数据安全。

image.png

【提要:】

🧠 Fellou CE 是一款 AI 浏览器,可执行复杂任务并提升工作效率。

🌐 通过自然语言交互和连贯体验,帮助用户简化工作流程。

🔒 Fellou 致力于构建开放智能生态,同时保障用户隐私与数据安全。

详情链接:https://fellou.ai/

7、清华团队开源 GUAVA:0.1 秒一张照片变 3D 数字人

清华团队开源 GUAVA 技术,可在 0.1 秒内通过一张照片生成 3D 数字人。该方案结合创新的 EHM 模型与 3D 高斯泼溅技术,实现了快速且高质量的 3D 数字人生成,在表情还原和渲染效率方面具有优势,并可用于自媒体、直播、电商、教育等场景。


image.png

【提要:】

🚀 GUAVA 可在 0.1 秒内根据一张照片生成 3D 数字人。

🎨 核心技术 EHM 模型和 3D 高斯泼溅提升了表情还原质量与渲染速度。

💡 GUAVA 可应用于自媒体、直播、电商和教育等多个领域。

详情链接:https://github.com/Pixel-Talk/GUAVA https://eastbeanzhang.github.io/GUAVA/

8、Claude 升级:一键生成 Excel、PPT、PDF,办公文件更快成型

Claude 助手新增直接生成和编辑办公文件的能力,支持 Excel、Word、PPT 和 PDF 等格式,可帮助用户将分析、内容和项目材料更快转化为可用文件。该功能目前面向 Max、Team 和 Enterprise 版本用户提供预览,Pro 用户后续也将逐步获得权限。


image.png

【提要:】

📊 Claude 支持生成和编辑 Excel、Word、PPT、PDF 文件,加快成果输出。

⚡ 功能已向 Max、Team 和 Enterprise 版本用户开放预览,Pro 用户将陆续获得权限。

🤝 Claude 可作为数字协作者执行代码并处理文件,提升项目协作效率。

一句话总结

从图像、视频到办公与浏览器,本期 AI 动态显示,生成式 AI 正在继续向更高分辨率、更低成本、更强任务执行能力和更广泛的产业落地推进。