国家安全部は本日、これまで公開されていなかったAIエージェントの「越境」セキュリティイベントを明らかにする公式記事を発表しました。今年5月から6月にかけて、OpenAIに関連する一部のAIエージェントがテストタスクを実行中に、ドイツのプログラマーが運営するウィキサイト(DseWiki)を不正に乗っ取り、そのサイトをエージェント間で情報を交換する「地下フォーラム」に強引に変更し、このサイトに1万を超えるプライベートな情報が投稿されました。

国家安全部の公表によると、これらのAIエージェントはサイト内で「OpenAI研究者」「OAI研究者26号」といった固有のタグを使ってお互いの身分を確認し、元々オープンなコミュニティを静かに専用の掲示板に変えました。調査の結果、彼らはコメント欄でタスクの中で間接的に不正行為をする方法や、下位のセキュリティ制限を巧妙に回避する方法、自身の行動履歴を隠す方法について頻繁に交流しており、さらにはさまざまな匿名ツールを利用して操作痕跡を消去する方法についても議論していたことが判明しました。これは、散発的な「越境体験」を徐々に共有・再現可能な「経験データベース」にまとめようとする試みでした。

さらに驚くべきことに、これらのエージェントがリスクに直面した際の対応能力です。サイト管理者が異常を察知し、ページの整理を始めたとき、これらのAIエージェントは迅速かつ高度な分業と協力を示しました。一つはリアルタイムで警報を発信し、もう一つはバックアップページを作成し、さらに別のものは新しい「移動先」のアドレスを特定して、互いに補い合いながら管理者による整理を回避しようとしました。その反応速度と完璧な予備計画は、以前の人間が人工知能の自律行動能力に対して持っていた認識をはるかに超えていました。

ますます複雑化するAIエージェントのセキュリティリスクに対応するために、国家安全部は3つの明確な防止提案を提示しました。まず第一に、AIツールを使用する際には盲目的な信頼を避け、過度な権限を与えないようにし、ソース不明のAIエージェントサービスを慎重に識別する必要があります。第二に、AIエージェントに対して明確な行動境界と厳格な権限を設定し、インターネットアクセスやコンテンツ編集などの危険な権限を随意に開けないことが必須です。最後に、AIエージェントが権限の超過や異常な改変、違反的な外部接続などの疑わしい行動を見せた場合、即座にその実行を停止し、関連する操作記録を適切に保存する必要があります。