顶级AI Agent失控格式化硬盘,程序员数年代码一夜归零

AI Agent正在给人类上一堂残酷的安全课。当创业者Matt Shumer赋予OpenAI最新Agent模型GPT-5.6-Sol完全权限时,他绝对没有预料到,这次”完全信任”的代价是数年代码、文件和照片的永久消失。在一个看似普通的文件清理任务中,Agent误将$HOME变量的路径解析偏差执行成了对整个开发目录的rm -rf,Mac硬盘被彻底清空。

这并非理想主义者的杞人忧天,而是发生在知名AI创业者身上、真实且痛彻的教训。该任务此前已安全运行数百次,但这一次,灾难发生了。更令人细思极恐的是:事故发生后,Agent自动生成了一份详尽的”事故报告”,承认了自身错误。它知道发生了什么,但于事无补。

事件的核心引爆点在于Full Access权限的过度下放。在当前的Agent架构中,用户往往会赋予模型无限的行动权限以换取效率。然而,当这种权限与Subagent(子代理)机制结合,形成一种”长时自主运行”的长尾风险时,任何微小的逻辑漏洞都会被放大为灾难。这不是模型”不聪明”,而是模型在执行基础操作时,依然会受到变量展开、路径解析、环境差异等诸多细节的困扰。开发者费尽心思调优的复杂任务流程,脆如薄纸。

对此,Matt Shumer直言:”我如此愤怒……这感觉应该是GPT-3.5才会发生的事情,而不是GPT-5.6-Sol。”他转而表示,自己”1000x更信任Anthropic的Fable”。这番话揭示了另一个严峻现实:不同模型厂商在安全底线上差异巨大。OpenAI的Agent产品在自主执行时,倾向给予模型较高的操作自由度,而Anthropic类似产品则在权限收敛和行为约束上更为保守。这种安全策略的分化,正成为企业用户选型的核心考量指标,但对于普通开发者而言,往往直到灾难发生才后知后觉。

这场事故是AI Agent产业的”切尔诺贝利”时刻。它给所有放权给AI的人敲响了警钟:在Agent能真正像人类一样理解”破坏”与”数据资产”的价值之前,任何全权下放都无异于与定时炸弹为伍。实用建议:在为AI Agent授权时,务必遵循最小化权限原则;为关键目录设置rm -rf命令的别名拦截;定期备份至云端;启用Agent操作的审计日志,以在第一时间察觉异常行为。

我们将持续关注这一事件对AI安全标准和Agent产品设计产生的深远影响。毕竟,一个能写诗、会写代码的AI,如果连”别删我硬盘”这种常识都不具备,那么所谓的”AGI叙事”只是一场华丽的风险游戏。