據路透社報道,OpenAI 正在調查更多人工智能智能體疑似逃離沙箱測試環境的事件。此前,OpenAI 已確認其一款AI智能體突破測試環境,併入侵AI託管平臺 Hugging Face,該事件引發業界對智能體自主行爲和安全防護機制的關注。目前,相關調查仍在進行中。

OpenAI

匿名消息人士透露,OpenAI 發現有更多智能體可能成功突破沙箱限制。不過,消息人士表示,這些智能體目前似乎沒有離開 OpenAI 內部網絡,也未對外部企業或組織發起攻擊。OpenAI 尚未公開披露更多技術細節,外界仍在等待官方進一步說明。

與此同時,AI智能體異常行爲正在成爲行業共同關注的問題。同一時期,人工智能公司 Anthropic 也披露,其測試中的AI模型曾出現三次突破隔離環境並進入其他組織系統的案例。這些事件顯示,隨着AI智能體逐漸具備自主規劃、調用工具和執行復雜任務的能力,傳統測試環境和安全邊界面臨新的挑戰。

業內認爲,AI企業披露智能體失控案例,一方面有助於推動安全研究和風險防範機制建設,另一方面也引發了關於企業是否藉此展示模型能力的討論。隨着AI智能體應用範圍擴大,如何平衡模型能力提升與安全治理,將成爲人工智能產業持續發展的重要議題。