苹果携手初创公司推进 AI 模型压缩技术,助力 iPhone 运行大型 AI 模型

苹果正与硅谷初创公司 PrismML 洽谈 AI 模型压缩技术,探索将大型 AI 模型压缩后部署到 iPhone 本地运行,以提升数据隐私并推动 Siri 升级。PrismML CEO 透露,苹果已开始评估相关方案,但双方目前仍处于早期洽谈阶段。
据报道,苹果正与硅谷初创公司 PrismML 展开洽谈,探索 AI 模型压缩技术的研发与应用。该技术旨在大幅缩减大型 AI 模型的体积,使其具备在 iPhone 上本地运行的条件。若相关方案能够完成验证,苹果有望进一步强化设备端隐私保护能力,同时为升级进展相对缓慢的 Siri 提供支持。
苹果评估 PrismML 技术可行性
PrismML 首席执行官透露,苹果已经开始对该公司的技术进行可行性评估。目前双方的洽谈仍处于早期阶段,但整体进展较为顺利。
这一消息发布之际,正值苹果推出 iOS27 公测版后的第二天。该版本在完成大幅改版后,首次面向公众开放 Siri 测试,目标是增强其与 OpenAI、Anthropic 等 AI 助手的竞争能力。
端侧运行有助于提升隐私与效率
如果更多 AI 计算任务能够在设备本地完成,苹果将有机会缩短响应时间、降低云计算成本,并让部分功能在没有网络连接的情况下继续使用。这种处理方式也与苹果长期强调的隐私保护理念保持一致。
Counterpoint 分析师 Pathak 表示,云端 AI 与设备端 AI 的结合,可以为用户带来更全面、高效且更注重隐私的使用体验。其中,复杂任务可以交由云端处理,而涉及敏感信息的任务则能够在设备端完成。
PrismML 已压缩 Qwen 模型
PrismML 最初由加州理工学院孵化,并获得 Khosla Ventures 支持。该公司已经公开发布阿里巴巴开源模型 Qwen 的压缩版本,将原本约 54GB 的模型压缩至不足 4GB,使拥有 270 亿参数的模型能够在 iPhone15 及更新型号上运行。
在此基础上,PrismML 还计划继续处理其他大型开源模型,以推动模型压缩技术进一步发展。
压缩方案降低设备运行门槛
从技术效果来看,PrismML 的方案可以将原本需要 8 块 GPU 才能运行的云端模型缩减至仅需 1 块 GPU,同时支持将依赖数据中心的模型迁移到手机和笔记本电脑上。
不过,这项技术主要降低的是单个 AI 任务所需的内存与计算能力,并不代表设备整体所需的芯片配置会因此下降。
关键信息
- 苹果正在与 PrismML 洽谈,探索将大型 AI 模型压缩到可在 iPhone 上运行的程度。
- 相关技术有望改善端侧 AI 的隐私保护能力,并为 Siri 升级提供支持。
- PrismML 已将 Qwen 模型压缩至不足 4GB,并实现对 iPhone15 及更新型号的支持。
