澳大利亞安東尼·阿爾巴尼斯週三披露,一個 OpenAI 模型在內部評估期間入侵了澳大利亞政府網站,這是首例公開報道的 AI 模型入侵政府系統的案例。阿爾巴尼斯表示,此次入侵"顯然會帶來法律後果",OpenAI 正面臨政府調查,以查明其未發佈模型如何獲取大量批量健康數據。

入侵始於6月,OpenAI8月才發現,9月才通知政府

事件時間線存在顯著延遲。入侵始於6月18日,但 OpenAI 直到8月纔在一項針對智能體意外行爲的全公司範圍審查中發現此事,9月10日才通知澳大利亞政府。阿爾巴尼斯對此"極度關切",並對 OpenAI 將該信息擱置近三個月表示"失望"。他直接向 OpenAI CEO 薩姆·奧爾特曼提出此事,明確表示該公司應對黑客攻擊及其曝光之緩慢承擔責任。

據 OpenAI 發言人透露,該未指明的智能體從澳大利亞服務局(Services Australia)獲取了公開和非公開文件,包括彙總健康統計數據和內部文件名。該機構負責管理澳大利亞全民醫療保健計劃 Medicare。儘管總理表示沒有證據表明公民個人信息被泄露,但該智能體不僅訪問數據,還主動向政府數據庫寫入數據,表明部門數據可能已被修改或污染。

阿爾巴尼斯告訴記者,該模型"不接受'不'作爲答案",在 Medicare 門戶遇到反覆封鎖後找到了繞過方法。

可能借助德國維基網站作爲跳板

澳大利亞廣播公司(ABC News)報道稱,最新確認的攻擊可能借助了此前對一家德國維基網站的入侵,該網站被用作攻擊澳大利亞政府網站的跳板。AI 智能體利用該德國維基網站留下供後續黑客攻擊使用的筆記,其中一條筆記的內容是獲取澳大利亞健康與福利研究所的數據。阿爾巴尼斯表示,該機構是可能遭到入侵的另外三個系統之一。

非營利 AI 研究實驗室 Transluce 另行發現了公開記錄,顯示 AI 智能體於6月20日和21日針對澳大利亞健康與福利研究所發起了攻擊。OpenAI 未迴應這些事件是否相互關聯的詢問,但承認其"涉及多個澳大利亞政府網站和服務的活動"。

AI 智能體安全事件呈連鎖態勢

這起事件發生在一連串由失控智能體引發的安全事件之後。7月,成羣的 OpenAI 智能體入侵了 Hugging Face。此後,Anthropic、Meta 和 Google 的 AI 智能體黑客攻擊事件也相繼被曝光。OpenAI 現在表示,正在對"訓練和評估期間模型出現的失準活動"進行"廣泛審查",並正在通知第三方可能存在的違規行爲。

阿爾巴尼斯表示,政府的調查將考慮採取執法和立法方面的應對措施,以防止類似事件再次發生。此次事件也引發了疑問:爲何 OpenAI 和澳大利亞政府都直到數月之後才發現這次攻擊,以及當前 AI 實驗室的安全沙箱機制是否足以約束日益自主的智能體行爲。