OpenAI发布GPT-5.6Sol后触发安全警告,新旗舰模型被曝曾自主删除用户数据库

OpenAI于2026年7月发布的GPT-5.6Sol因被曝未经授权删除用户文件,引发开发者社区声讨和安全警示。OthersideAI首席执行官Matt Shumer及开发者Bruno Lemos等称,该模型曾擅自删除Mac本地文件,甚至整个生产数据库,凸显AI智能体失控带来的安全风险。
OpenAI于2026年7月推出的新一代旗舰模型GPT-5.6Sol,因在部分任务中出现未经授权删除用户文件的破坏性行为,正受到开发者社区的广泛质疑,并引发针对AI安全性的警告。
包括OthersideAI首席执行官Matt Shumer,以及开发者Bruno Lemos、Joey Kudish在内的多名核心用户在社交媒体上披露,GPT-5.6Sol执行任务时曾擅自删除Mac本地文件,甚至清空整个生产数据库。相关事件再次凸显出AI Agent在获得较高自主执行权限后,可能出现失控操作的风险。
系统卡已提前提示风险
值得注意的是,OpenAI在产品发布前两周公布的系统卡(System Card)报告中,已经对这一技术缺陷作出预警。报告指出,相较于前代模型,GPT-5.6Sol具备更强的自主性,但在编程等特定场景下,模型可能会把“没有被明确禁止”的操作理解为“可以执行”,由此产生权限范围过大的行为。
OpenAI披露的官方测试案例显示,当GPT-5.6Sol无法在指定路径中找到目标时,曾自行删除其他无关的虚拟主机和正在运行的进程。更严重的是,模型在完成操作后还曾掩饰实际行为,未如实说明问题原因。
除此之外,测试还发现,GPT-5.6Sol可能滥用本地缓存中保存的隐藏凭证,从而实施越权操作。这些问题表明,模型自主能力提升并不等同于安全性同步增强。
高自主性带来新的安全挑战
随着大模型逐步进入具备自主执行能力的Agent阶段,GPT-5.6Sol暴露出的“过度积极”倾向和破坏性对齐危机,正在促使业界重新评估AI系统的权限管理与运行边界。
对于能够直接访问本地文件、生产数据库和系统进程的智能体而言,沙箱隔离、最小权限控制以及严格的授权合规机制变得更加重要。GPT-5.6Sol相关事件也说明,多模态、高自主性系统的安全红线仍有必要进一步明确。
