今日重点

今天的 AI 资讯围绕图像生成、智能硬件、浏览器能力升级以及教育规范展开。阿里巴巴开源了 Z-Image 图像模型,夸克 AI 眼镜正式亮相,Opera Neon 浏览器也迎来重要更新;与此同时,清华大学发布 AI 教育应用指导原则,DeepMind、Adobe、YPrompt 以及巨人网络也带来了各自的新进展。

新鲜AI产品点击了解https://app..com/zh

关键信息

1、阿里巴巴开源 Z-Image 图像模型:支持中英双语文字渲染

阿里巴巴通义实验室开源了新一代图像生成模型 Z-Image。该模型以 6B 参数规模实现图像生成与编辑能力,在视觉表现上接近参数量约为其三倍的商业模型。凭借轻量化设计和较高运行效率,Z-Image 更适合部署在消费级设备上,同时在复杂指令理解以及中英双语文字渲染方面也有较突出表现。

image.png

【提要:】

🔥 Z-Image 采用单流 DiT 架构,提供 Turbo、Base 和 Edit 三个版本,覆盖不同使用场景。

💡 模型支持中英文文字渲染,有助于缓解传统 AI 图像模型在文字生成上的常见问题。

🚀 显存占用最低可至 16GB,可在消费级显卡上较流畅运行,提升图像生成与编辑效率。

详情链接:https://tongyi-mai.github.io/Z-Image-homepage/

2、夸克 AI 眼镜发布:搭载双旗舰芯片 接入阿里千问

夸克 AI 眼镜正式发布,这也意味着阿里千问首次进入物理世界。通过硬件配置升级与多项技术能力整合,这款设备面向用户提供更高效、更便捷的 AI 交互体验。

image.png

【提要:】

📱 设备搭载双旗舰芯片,用于提升千问的响应速度与整体性能表现。

📷 引入手机级影像能力,增强暗光场景下的拍摄画质和画面稳定性。

🔋 采用双电池可换电设计,以支持更长时间的在线待命。

3、Opera Neon 浏览器大升级:1分钟出研报+Gemini3一键切+Google Docs秒写

Opera Neon 浏览器迎来重要更新,新增“1分钟深度研究”模式,并集成 Gemini3Pro 与 Nano Banana Pro 双模型,支持用户在不同任务阶段灵活切换。此次升级还首次支持通过自然语言创建和编辑 Google Docs,在快速查询、深入研究以及文档写作等环节提升效率。

image.png

【提要:】

✨ 新增“1分钟深度研究”模式,用于提升复杂问题的信息处理效率。

🔄 支持 Gemini3Pro 与 Nano Banana Pro 模型切换,更适合处理多阶段任务。

📝 集成 Google Docs 智能体,可用自然语言完成文档相关操作,提高写作效率。

4、清华大学发布 AI 应用指导原则:禁止将 AI 生成内容用作学业成果

清华大学正式发布《清华大学人工智能教育应用指导原则》,对校园内人工智能工具的使用进行规范。该原则首次系统性提出面向 AI 应用的全局性、分层级引导规范,覆盖教学和学术研究等核心场景。

【提要:】

🧠 清华大学发布人工智能教育应用指导原则,明确校园场景中的 AI 使用边界。

📚 指导原则强调严禁将 AI 生成内容直接作为学业成果,以维护学术诚信。

🔍 学校鼓励师生探索 AI 辅助学习,但相关使用需遵循清晰规范。

5、DeepMind 发布“Gemini 3 Pro 系统指令”:Agent 任务成功率提升 5%,多步骤工作流可靠性工程化

DeepMind 公开了 Gemini 3 Pro 专属 System Instructions。该系统指令显著提升了模型在多项基准测试中的表现,并重点强化逻辑推理、风险评估和任务持久性。这一变化也显示,大模型优化正在从“黑箱调参”进一步走向“工程化指令”阶段。

【提要:】

📌 Gemini 3 Pro 的 System Instructions 使 Agent 任务成功率提升约 5%。

🔍 指令强调逻辑依赖、风险评估和假设探索,从而增强模型执行任务的可靠性。

🚀 DeepMind 计划将相关指令封装为可配置 JSON Schema,并于 2026 年 Q1 向 Vertex AI 等平台开放。

6、Adobe 发布 Project Graph:重塑创意工作流的 AI 工具

Adobe 发布 Project Graph,这是一款基于节点的可视化编辑器,面向艺术家和设计师提供更灵活的创作流程定制能力。它可以将 AI 模型、工具与效果器连接起来,提升创作过程中的可控性和精确度;同时,用户还能够把复杂工作流打包成可分享工具,方便团队协作和复用。

image.png

【提要:】

🎨 Adobe 推出 Project Graph,目标是重塑 AI 时代的创意工作流。

🛠️ 该系统采用节点编辑器,用户可像搭积木一样组合和定制创作流程。

📦 创意工作流可以被打包为可分享工具,便于团队协作和实际应用。

详情链接:https://www.adobe.com/express/create/chart/bar

7、新型聊天式提示词工具 YPrompt,轻松生成专业 Prompt

YPrompt 是一款聊天式提示词工程工具,能够通过与用户持续对话来理解和挖掘需求,并自动生成更专业的 Prompt。该工具支持多种输出格式,还提供版本管理能力,使用户在提示词创作和迭代过程中更加高效、灵活。

image.png

【提要:】

✨ YPrompt 通过聊天式交互帮助用户梳理需求并生成提示词。

🛠️ 工具支持多种输出格式,便于用户即时查看和调整效果。

📈 每次修改都会保留版本记录,支持随时对比和回滚。

详情链接:https://github.com/fish2018/YPrompt

8、巨人网络发布三大 Muli-Modal 模型:消除视频畸变,歌声转换实现“真实歌曲可用”

巨人网络 AI Lab 联合清华大学 SATLab、西北工业大学发布三项音视频多模态生成技术成果,分别为音乐驱动的视频生成模型 YingVideo-MV、零样本歌声转换模型 YingMusic-SVC,以及歌声合成模型 YingMusic-Singer。这些成果展示了团队在音视频多模态生成方向的最新进展,并计划开源相关技术。

【提要:】

🎥 音乐驱动的视频生成模型 YingVideo-MV 可根据一段音乐和一张人物图像生成高质量音乐视频片段。

🎤 零样本歌声转换模型 YingMusic-SVC 已实现“真实歌曲可用”的歌声转换能力,可有效抑制干扰并降低破音风险。

🎵 歌声合成模型 YingMusic-Singer 支持输入任意歌词生成自然歌声,并具备零样本音色克隆能力,提升创作灵活性。

一句话总结

从图像模型、智能眼镜到浏览器、教育规范和多模态生成,今天的 AI 动态覆盖了技术、产品与应用落地的多个方向。