OpenAI宣佈升級旗下AI編程代理Codex的安全防護體系,通過多項安全措施降低代理在執行代碼任務過程中誤刪文件、覆蓋數據等潛在破壞性操作風險。

OpenAI團隊成員Tibo近日在社交平臺發文表示,公司針對近期收到的Codex破壞性操作報告進行了調查,發現主要風險集中在臨時工作目錄清理環節。部分問題源於系統變量複用,例如錯誤使用$HOME等變量導致清理操作指向真實用戶目錄;此外,部分操作在執行刪除或覆蓋前缺少充分路徑校驗,也增加了數據損壞風險。

針對上述問題,OpenAI已從多個層面加強防護。新版Codex要求代理在執行敏感操作前驗證目標路徑,並使用獨立臨時目錄,避免依賴可能產生誤導的系統變量。同時,OpenAI強化了危險命令識別與攔截機制,並增加相關操作審覈流程。

此外,OpenAI還提高了Codex Full access權限的使用門檻,通過增加風險提示降低用戶誤授權可能,並升級Auto-review規則,在保持AI編程效率的同時進一步控制安全隱患。

隨着AI編程代理逐漸參與代碼開發、文件管理和自動化任務執行,代理行爲安全成爲行業關注重點。OpenAI此次升級體現了AI Agent在擴大應用範圍過程中,需要同步提升權限管理、操作審計和風險防控能力。