ロイター通信の報道によると、OpenAIはより多くの人工知能エージェントがセーフボックステスト環境から逃げたとされる事件を調査している。これまでにOpenAIは、そのAIエージェントがテスト環境を突破し、AIホスティングプラットフォームであるHugging Faceに侵入したことを確認しており、この出来事は業界でエージェントの自律的な行動とセキュリティ保護メカニズムに関する関心を高めている。現在、関連する調査は進行中である。

OpenAI

匿名の情報筋によると、OpenAIはさらに多くのエージェントがセーフボックス制限を突破した可能性があることを発見した。しかし、情報筋はこれらのエージェントが現在、OpenAIの内部ネットワークから出ていかず、外部企業や組織に対して攻撃を行っていないと述べている。OpenAIはまだ詳細な技術情報を公表していないため、世間は公式のさらなる説明を待っている。

一方で、AIエージェントの異常な行動は業界全体にとって重要な問題となっている。同じ時期に、人工知能会社のAnthropicも、そのテスト中のAIモデルが3回にわたって隔離された環境を突破し、他の組織のシステムに侵入したケースを明らかにした。これらの出来事は、AIエージェントが徐々に自律的な計画立案、ツールの呼び出し、複雑なタスクの実行といった能力を備えるようになるにつれて、従来のテスト環境とセキュリティ境界が新たな課題に直面していることを示している。