欢迎关注【AI日报】。本栏目持续追踪人工智能领域的新动态,重点覆盖技术进展、产品发布与应用趋势,帮助开发者与行业读者快速了解当天值得关注的AI资讯。
新鲜AI产品点击了解:https://app..com/zh
今日重点
本期AI日报聚焦多款AI产品与模型的最新更新:阿里夸克推出AI创作平台“造点”,接入通义万相Wan2.5与Midjourney V7;Wan2.5-Preview亮相,主打多模态输入和视听同步生成;可灵AI发布可灵2.5Turbo,并宣布价格较此前版本下调近30%。此外,阿里通义、谷歌、Qwen和Figma也分别在音视频转录、图片编辑、情绪板生成、模型能力升级以及设计转代码等方向带来新进展。
1、阿里夸克上线AI创作平台“造点”,接入通义万相Wan2.5和Midjourney V7
阿里夸克正式推出AI创作平台“造点”。该平台整合了通义万相Wan2.5与Midjourney V7能力,既可用于音画同步的视频生成,也支持更进阶的图像创作功能,并面向普通用户提供更轻量、易上手的AI创作体验。

关键信息:
🎥 “造点”接入通义万相Wan2.5,可支持音画同步视频生成。
🎨 平台引入Midjourney V7,覆盖多图参考、风格代码等高级图像创作能力。
📱 产品面向普通用户降低使用门槛,可用于日常修图和创意表达等场景。
2、Wan2.5-Preview发布,支持多模态输入与电影级视频同步生成
Wan2.5-Preview的发布,进一步提升了AI视觉生成在多模态理解、生成质量和精细化控制方面的表现。该版本在视频生成、图像生成以及基于指令的编辑等方面均有增强,为开发者和内容创作者提供了更完整的生成式工具能力。

关键信息:
🎥 视频生成强调高保真、高一致性的视听同步能力,可生成多人声、音效和BGM。
🎨 图像生成能力得到提升,可覆盖逼真图像、多种艺术风格以及专业图表等内容类型。
🔄 支持对话式、基于指令的图像编辑,并可实现像素级精度操作。
3、可灵AI发布视频生成模型可灵2.5Turbo,并宣布降价近30%
可灵AI近日推出最新视频生成模型可灵2.5Turbo,同时宣布价格较此前版本下降近30%。这一价格调整使可灵AI在视频大模型订阅市场中的定位更加突出,也反映出不同厂商在定价策略上的进一步分化。
关键信息:
🎥 可灵AI发布视频生成模型可灵2.5Turbo,并宣布价格下调近30%。
💰 可灵AI会员体系分为多个层级,基础会员价格为66元,最高级别会员月费为1314元。
📈 可灵AI是唯一公开披露营收的大模型厂商,二季度营收已超过2.5亿元。
4、阿里通义发布Qwen3-ASR-Toolkit,服务音视频转录需求
阿里通义Qwen团队推出Qwen3-ASR-Toolkit。这是一款开源Python命令行工具,主要面向小时级音视频转录场景。该工具基于Qwen3-ASR-Flash模型,支持多种音视频格式,并具备智能静音切分、多线程并行上传等能力,有助于提升转录效率与识别准确性。

关键信息:
🎧 工具突破三分钟限制,可支持小时级音视频转录。
🧠 基于Qwen3-ASR-Flash模型,面向高准确率语音识别场景。
🔄 支持多种音视频格式,增强转录处理的灵活性与效率。
详情链接:https://github.com/QwenLM/Qwen3-ASR-Toolkit
5、谷歌相册AI编辑功能面向安卓用户扩展,可用自然语言修图
谷歌推出的AI编辑功能通过自然语言交互简化照片处理流程,使安卓用户能够通过文字指令完成图片编辑。该功能此前为Pixel 10设备独占,如今已扩展至所有安卓用户,支持光线调整、背景移除等高级操作,进一步提升移动端修图体验。
关键信息:
🤖 谷歌AI编辑功能允许用户通过自然语言指令编辑照片。
📷 功能覆盖光线调整、背景移除、老照片修复等高级图片处理操作。
🌐 谷歌同时推进AI透明度建设,支持C2PA内容凭证以维护信息真实性。
6、谷歌推出实验性AI工具Mixboard,用于创建情绪板
谷歌发布实验性工具Mixboard,主要面向创意设计和灵感探索场景。用户可以借助模板、文本提示、上传图片或自然语言描述生成视觉内容,适用于家居装饰、活动策划等用途。该工具还提供一键再生和图像编辑功能,帮助用户在设计过程中更高效地调整方案。

关键信息:
🎨 Mixboard是谷歌推出的AI工具,可帮助用户快速生成个性化情绪板,并支持模板和文本提示。
🖌️ 用户可以上传图片,也可以用自然语言生成视觉内容,适用于家居装饰、活动策划等场景。
🔄 工具支持一键再生和图像编辑,提升创作过程中的调整灵活性。
详情链接:https://labs.google.com/mixboard/welcome
7、Qwen推出新模型Qwen3-Max,提升代码生成与推理表现
Qwen团队发布全新AI模型Qwen3-Max。该模型在多个基准测试中取得亮眼表现,尤其在代码生成和智能体能力方面受到关注。Qwen3-Max采用MoE结构设计,并具备较大参数规模,以提升训练效率和稳定性。与此同时,Qwen3-Max-Instruct与Qwen3-Max-Thinking也展现出面向开发和推理任务的性能优势。
关键信息:
🧠 Qwen3-Max参数规模超过1万亿,预训练使用36万亿个tokens。
💻 Qwen3-Max-Instruct在编程基准测试中表现优异,体现出较强的实用编程能力。
🧮 Qwen3-Max-Thinking在数学推理测试中取得满分,展示了较强推理能力。
8、Figma MCP服务器升级,加速设计到代码的自动化流程
Figma对MCP服务器进行升级,进一步优化设计与开发之间的协作流程。通过标准化协议,AI模型可以直接读取设计文件中的语义层信息,无需依赖客户端,也减少了截图和人工描述带来的信息损耗。这一升级有助于提高前端实现效率,并推动设计系统与开发工作流更紧密结合。

关键信息:
✅ 远程访问能力使AI模型可直接读取设计文件语义层信息,无需截图或手动描述。
🔄 与Figma Make集成后,可从Make文件中提取资源并转化为代码级资产。
⚡ Code Connect UI组件映射优化,有助于提升AI生成代码的还原度,并缩短开发时间60%-80%。
详情链接:https://127.0.1:3845/sse
一句话总结
本期AI日报集中呈现了AI视频生成、图像编辑、语音转录、设计协作和大模型能力升级等方向的新进展,生成式AI正在进一步融入创作与开发流程,并朝着更易用、更高效的方向演进。
