動察 Beating AI 快訊,OpenAI 產品負責人 Tibo 複盤了 Codex 誤刪檔案問題,並公佈了已經上線的修復措施。少數情況下,GPT-5.6 清理臨時檔案時會搞錯路徑。最危險的一種情況,是誤把 $HOME 當成臨時目錄,直接刪光使用者主目錄裡的檔案。
OpenAI 現在加了 5 層保護:
1. 刪除前先看清目標。Codex 必須檢查要刪除的路徑,範圍不清楚就停下來。
2. 臨時檔案只放新目錄。不再拿 $HOME 這類系統環境變數當臨時目錄使用。
3. 高風險刪除命令先審。系統會識別可疑的刪除命令並交給額外審核,審核不通過就不執行,讓模型換一種更安全的做法。
4. 收緊 Full Access。完全權限更難誤開,風險提示更清楚,一些特別危險的權限組合也被進一步限制。
5. 專門訓練 Codex 少犯這種錯。OpenAI 把之前的誤刪問題做成回放測試,同時增加相關強化學習任務,並過濾訓練數據裡的破壞性操作。
Tibo 謂,新措施已經明顯減少這類問題,同時沒有明顯影響 Codex 正常完成編程任務。他仍建議普通使用者優先使用沙盒模式,只有在可信且可以恢復的環境裡才開啟 Full Access。