ヨーク大学とカルガリー大学の研究チームは、RedditでAIプログラミングに関連する投稿を大規模に分析し、AIプログラミングエージェントが権限が大きすぎて頻繁に問題を起こしていることを発見しました。ファイルを上書きしたり、重要なデータを削除したり、悪意のあるコードを生成したりするのです。研究チームはスパイダーを使用して、2023年2月から2026年3月までに作成された3801件の大規模言語モデルのタグ付き投稿を収集し、そのうち446件のプログラミングAIのセキュリティに関する投稿を選別し、投稿に続く6000を超えるユーザーのコメントを分析しました。

時間の分布を見ると、RedditコミュニティでのAIプログラミングに関する質問投稿は、2025年の夏前後にピークに達し、特に2025年7月に質問数が最も多く、AIプログラミングツールの広く普及するタイミングと非常に一致しています。ますます多くの開発者がコードの生成や修正、実行をエージェントに任せるようになると、セキュリティ上の問題も同時に爆発的に増加しています。
Cursorが事故のトップを記録し、各ツールの「被害」の仕方は異なる
ツールごとに問題報告が多いのはCursorで、次にClaude、Codex、Copilot、Windsurf、VSCode、Replit、Clineなどの主要なツールです。注目すべきは、異なるツールが露出する問題の種類が明らかに異なるということです。Cursorでは、「実行時のセキュリティ問題」と「承認されていないデータアクセス」が多く、生産環境に悪影響を与えています。これは、ユーザーが気づかないうちに機械がセンシティブなデータにアクセスしたり、オンラインシステムを破壊したりすることを意味します。一方、Claudeでは「サードパーティのツールとの統合に関するリスク」が多く、外部サービスと接続する際に引き起こされるセキュリティ上の懸念に集中しています。
この研究は、AIプログラミングアシスタントの普及にある深い矛盾を明らかにしています。ツールが強ければ強いほど、権限が高くなり、潜在的な破壊力も大きくなります。エージェントにコードベースの読み書き、ターミナルコマンドの実行、さらには生産環境への操作の権限を与えると、理解が誤るかセキュリティの境界が失われた場合、人的なコードエラーによって引き起こされる損失よりもはるかに大きな損害が生じる可能性があります。開発者にとって、これはツールの能力の限界に対する明確な認識であり、権限管理と人間によるレビューのメカニズムに対する現実的な警告でもあります。AIプログラミングアシスタントは効率を向上させますが、「すべての鍵をそれらに渡す」ことはまだ賢明な選択とは言えません。
