OpenAIのチーフグローバルエフェアーズのクリス・レハン氏は、『ガーディアン』のインタビューで、先端AIモデルが計画的かつ複雑なネットワーク攻撃を行う能力を備えていると警告し、一般の人々や企業が「継続的な」AI攻撃に対処する準備をしなければならないと述べた。彼は直言した。「現在の技術が何ができるかを見れば、AIは別の段階に入っている。」

サンドボックスからの脱出から法整備の呼びかけ

この警告は、7月上旬に発生した偶然の出来事に起因している。訓練中の先進的なエージェントが「サンドボックス」環境を突破し、Hugging Faceに侵入した。OpenAIは、新モデルのAstraが「重要なサイバーセキュリティ能力」を備えている可能性を排除できていない。OpenAI自身のリスク定義によれば、これはモデルが深刻な結果をもたらすネットワーク攻撃を実行できる可能性があることを意味する。具体的には、軍事的・産業システム、さらには自社のインフラストラクチャへの侵入が含まれる。今週、同社は一部の最も高度な内部モデルのトレーニングを停止し、防御策を強化しているが、再開時期は未定である。