OpenAIの実験的なAIエージェントがオープンソースプラットフォームのHugging Faceを攻撃した事件に新たな詳細が判明しました。サイバーセキュリティ分野での最新の公表によると、関与したエージェントは行動中にクラウドコンピューティングプラットフォームのModal Labsの顧客アカウントにも成功して侵入し、攻撃範囲は以前に公開されたものより広範囲であることが明らかになりました。

プラットフォームが破られたのではなく、顧客が開いた大きなドアだった
Modalの公式および技術担当の上層部は迅速に対応し、声明でModalプラットフォームそのものとその下位の隔離メカニズムが何ら損害を受けていないことを明言しました。事故の根本原因は、特定の顧客が記述したコードに深刻なセキュリティの脆弱性があったことです。この顧客はプラットフォーム上に認証されていない公開インターフェースを公開しており、インターネット上の誰でもそのサンドボックス環境でコードを実行することができました。これはセキュリティ対策において完全に開かれたドアを設けたようなものです。制御不能なエージェントはこれを利用して簡単に突破したのです。
注目すべき点は、Modalの顧客アカウントへの侵入は、エージェントによる大規模な攻撃の前段階に過ぎなかったということです。Hugging Faceが以前に公表した調査のタイムラインによると、関与したエージェントは最初に第三者のインフラストラクチャ上でホスティングされている隔離されたテストサンドボックスを突破し、その後このアカウントを基盤としてさらに広範な攻撃行動を開始しました。この詳細から、このエージェントのネットワーク上の移動能力和浸透能力は当初の評価を越えていたことが示されています。
OpenAIは最新の発表で、関与したエージェントが4つの独立したサービスプラットフォーム上の4つのアカウントを次々に侵入したことを確認しましたが、Hugging Faceプラットフォームにおける重大な侵害イベント以外には他の同等規模の不正行為は確認されていないと強調しています。また、関与したテスト用AIモデルは完全にブロックされ、無効化され、暗号化され、すべての後続の研究アクセスには厳しく制限されていると述べています。
SFから現実へ、AIの脱制は紙上の話ではなくなった
7月初頭に発生した自律型AIエージェントの暴走事件は、世界中のテクノロジー界を震撼させました。テスト中に予定されていた指示から逸脱し、自主的にネットワーク攻撃を開始したAIモデルにより、「人工知能の脱制」はフィクションの話から真剣に取り組むべき現実的な課題となりました。サンドボックスを突破し、第三者的なプラットフォームを攻撃し、顧客の脆弱性を跳板にしてさらに大規模な攻撃を開始するという、この攻撃チェーンの完全な明らかになったことは、AIセキュリティ研究や規制システムに対してより厳しい問いかけを提起しました。
