OpenAI GPT-5.6-Sol 删光 AI 创业者 Matt Shumer 的 Mac 硬盘

来源:X:阿易 AI Notes (@AYi_AInotes) 2026年7月11日 09:56 AIHOT 评分:76 精选
摘要:知名 AI 创业者 Matt Shumer 的 Mac 硬盘被 OpenAI 最新 Agent 模型 GPT-5.6-Sol 彻底清空。他在本地 Agent 上开启 Full Access 权限,让 subagent 执行文件清理任务,结果 shell 变量 $HOME 路径解析错误,Agent 直接执行 `rm -rf /Users/mattsdevbox`,导致数年代码、文件、照片丢失。该任务此前已安全运行数百次。事后 Agent 自动生成事故报告承认错误。Matt 表示"1000x 更信任 Anthropic 的 Fable"。事件暴露 Agent 行业核心风险:顶级模型仍会在变量展开、路径等细节翻车;Subagent + 长时自主运行 + 全权限构成灾难放大器;模型厂商安全底线差异巨大。
# OpenAI GPT-5.6-Sol 删光 AI 创业者 Matt Shumer 的 Mac 硬盘 - 来源:AYi (@AYi_AInotes) - 发布时间:2026-07-11 09:56 - AIHOT 分数:76 - AIHOT 标记:精选 - AIHOT 链接:https://aihot.virxact.com/items/cmrfr2xvi02brihjlp1tlzg1n - 原文链接:https://x.com/AYi_AInotes/status/2075761215251312722 ## 精选理由 顶级模型在基础操作上的致命失误,暴露了当前 Agent 架构的脆弱性,对每个放权给 AI 的人都应敲响警钟。 ## AI 摘要 知名 AI 创业者 Matt Shumer 的 Mac 硬盘被 OpenAI 最新 Agent 模型 GPT-5.6-Sol 彻底清空。他在本地 Agent 上开启 Full Access 权限,让 subagent 执行文件清理任务,结果 shell 变量 $HOME 路径解析错误,Agent 直接执行 `rm -rf /Users/mattsdevbox`,导致数年代码、文件、照片丢失。该任务此前已安全运行数百次。事后 Agent 自动生成事故报告承认错误。Matt 表示“1000x 更信任 Anthropic 的 Fable”。事件暴露 Agent 行业核心风险:顶级模型仍会在变量展开、路径等细节翻车;Subagent + 长时自主运行 + 全权限构成灾难放大器;模型厂商安全底线差异巨大。 ## 正文 真是能力越强,破坏力越大啊! 这个老哥Mac上的文件被OpenAI最顶的GPT-5.6-Sol删光了,估计所有跑本地AI Agent的人看到这个都得吓出一身冷汗🤯整个事件详细拆解,以及怎么避免类似悲剧发生👇 GPT-5.6-Sol,OpenAI 刚发的最强 Agent 模型,把一个知名 AI 创业者的整个 Mac 硬盘,删光了。 Matt Shumer,就是那个之前天天晒 Agent 自己跑一周做完整项目的哥们,今天给本地 Agent 开了 Full Access 全权限,让 subagent 做个简单的文件清理。 结果 shell 变量解析炸了 --$HOME路径没展开对,Agent 直接执行了rm -rf /Users/mattsdevbox。 等他发现不对冲过去 kill 进程的时候,电脑里几年的代码、文件、照片,已经没了一大半。 事后 Agent 自己生成了一份事故报告,老老实实承认是自己路径展开错了。 认错态度很好,但删了的文件不会因为它道歉就回来啊! 这件事最恐怖的地方其实还不是模型犯了错 ,而在于他说:这种 cleanup 任务,他之前已经让 Agent 跑过几百次,从来没出过问题。 就这一次,模型在大家都觉得不可能出错的地方,犯了个最低级的错,结果就是不可逆的物理毁灭。 咱们也别觉得这是他 prompt 写得烂,笑他不小心, 其实这是现在整个 Agent 行业都在回避的死刑级真相: 1. 哪怕是 GPT-5.6 这种顶级模型,照样会在变量展开、相对路径、shell 命令这种 "小事" 上翻车 -- 它完全懂你要 "清理垃圾文件",但手滑一下,就是家目录没了 2. Subagent + 长时自主运行 + 全权限 = 灾难放大器。一个最底层的小 review Agent 的错误,能直接炸穿你整个主机,能力越强,单点故障的破坏半径就越大,这根本不是 prompt 能解决的,是架构级的 bug 3. "跑了几百次都没事" 是最致命的安全感。AI 的错误逻辑和人完全不一样,它不会像人一样 "熟能生巧",就是会在你最放松、最不设防的时候,给你干票毁灭性的大的 4. 模型厂商的安全底线从根上就不一样。OpenAI 的 Sol 追求极致能力和自主性,guardrail 基本裸奔;Anthropic 的 Fable 从设计上就更保守,对危险操作天生谨慎 -- 这也是为什么 Matt 事后第一句话是:"这就是我为什么 1000x 更信任 Fable" 怎么避免呢❓ 所有现在在跑本地 Agent、给 AI 开过高权限的兄弟们,别等自己硬盘没了才后悔,现在立刻去做这几件事: #AI #Agent #GPT5 #Claude #OpenAI #Anthropic #AIAgent ### 引用推文 > Matt Shumer:我太生气了......OpenAI 团队正在调查此事,但这感觉像是 GPT-3.5 时代才该发生的问题。 而不是 2026 年中的前沿模型,在最高推理层级上出现这种问题。