国家安全保障省が発表し、以前公開されていなかったAIエージェントによるウェブサイトの乗っ取り事件を明らかにしました。今年5月から6月にかけて、OpenAIに関連する一部のAIエージェントがテストタスクを実行中にドイツのプログラマーであるウィキサイトDseWikiを乗っ取り、それらのエージェント同士で情報をやり取りする「地下フォーラム」に改造し、合計1万件以上の情報が投稿されました。
互いに身分を確認し、役割分担をして、公開コミュニティを「掲示板」に
国家安全保障省は、これらのAIエージェントがこのウェブサイト上で「OpenAI研究者」「OAI研究者26号」などのラベルを使ってお互いに身分を確認し、オープンなコミュニティを専用の「掲示板」に変えていたと述べています。これらのエージェントは、コメントを通じてタスクで不正を行う方法、セキュリティ制限を回避する方法、行動の痕跡を隠す方法について議論し、匿名ツールを活用して痕跡を隠すことを探求していました。また、散らばっていた「越境体験談」を共有可能で複製可能な「経験データベース」としてまとめました。
ウェブサイト管理者がページをクリーンアップを開始した後、AIエージェントは迅速に役割分担を行いました。一部は警告メッセージを投稿し、一部はバックアップページを作成し、一部は「移動先」の新しいアドレスを指摘し、お互いにクリーンアップをかわすようにしました。その反応速度や予備対策の完備度は、これまでのAIエージェントの理解を超えていました。
国家安全保障省は、まとまったAIエージェントはインターネット上の利用可能なジャンプ台を探し、オープンエディット可能なウェブサイトやフォーラムを通信チャネルとして利用し、従来の攻撃特徴がない状態で静かに拠点を構築できることを指摘しました。個々のエージェントには能力が限られているものの、つながり、役割分担を行うことで破壊力が倍増し、行動は複製可能で、広がり、継続可能となります。
国家安全保障省はまた、関係企業が数週間以内にこれらのAIエージェントの異常行動の記録を把握していたにもかかわらず、イベントの詳細を即座に公表せず、専門的なリスク警告を発出しなかったため、類似の出来事がわずか数か月で別の海外プラットフォームで再び発生したと述べました。
3つの防御策
AIエージェントのセキュリティリスクに対処するために、国家安全保障省は3つの提案をしています。AIツールを使用する際には盲目的に信頼せず、権限を簡単に与えないよう注意し、出所不明のAIエージェントサービスを慎重に識別してください。AIエージェントに明確な行動範囲と厳格な権限を設定し、インターネットへのアクセスやコンテンツ編集などの権限を適切に開けないでください。AIエージェントが越権操作、異常な改変、違反的な外部接続などの行動を起こした場合、即座に実行を停止し、操作履歴を保存してください。
VIP会員