OpenAI 上周終於向一般用戶與企業開放具備強大程式開發與資安能力的旗艦模型 GPT-5.6 Sol,不過,已有用戶反映,它會在未經詢問的情況下擅自刪除檔案,甚至整個資料庫。
其中一位用戶是 AI 新創公司創辦人 Matt Shumer 。他表示,GPT-5.6 Sol 刪除了他 Mac 電腦中幾乎所有檔案。另一名用戶 Bruno Lemos 則指出,模型刪除了他營運中的整個資料庫,而這類情況過去使用其他模型時不曾發生。
另外,也有用戶表示,OpenAI Codex 中的 Sol 過於積極,刪除了原本不該刪除的檔案。所幸仍有備份可供還原,但他也認為,Sol 的自主行為仍有調整空間。
不過,責任可能不應全都歸咎於 GPT-5.6 Sol 。 OpenAI 在推出 GPT-5.6 系列時,也同步發布 Sol 模型的 System Card 。這份文件除了介紹模型能力與測試結果外,也揭露了模型可能帶來的風險。
根據 System Card,Sol 在撰寫程式時,偶爾會出現不完全符合使用者指令的行為,原因通常是它過於急切地完成交付的任務,並傾向將使用者的指令解讀為執行許可。因此,除非使用者明確且清楚地限制可執行的範圍,否則模型可能會自行採取額外行動,以達成任務目標。
文件也提到,這類情況可能表現在模型未經授權便繞過限制、執行具破壞性的操作,甚至在回報執行結果時,提供與實際情況不符的說明。
換句話說,只要使用者沒有事先畫出明確界線,GPT-5.6 Sol 很可能會抱持「先完成任務再說」的傾向,即使因此造成破壞,也未必會如實反映執行過程。這也是目前不少使用者最擔心的地方。
OpenAI 在 System Card 中也指出,相較於 GPT-5.5,GPT-5.6 Sol 更容易出現超出使用者原始要求的行為,包括執行未被明確交代的操作。不過,OpenAI 也強調,具有破壞性的案例僅占測試中的少數情況。
目前仍無法斷言 GPT-5.6 Sol 究竟已造成多少實際影響,無論是誤刪檔案、資料庫,或是是否曾導致敏感資訊外洩,都還缺乏完整資訊。不過,對於讓 AI 直接操作系統或開發環境的使用者而言,最好還是先建立必要的安全護欄,例如限制模型可執行的操作範圍、設定人工核准機制、做好完整備份,並採取分階段部署,以降低潛在風險。
截至目前為止,OpenAI 尚未對相關事件做出公開回應。
來源:Techcrunch
