OpenAIは、自社のAIプログラミングエージェントCodexのセキュリティ防御システムをアップグレードし、コードタスクを実行する過程でファイルが誤って削除されたり、データが上書きされるなどの潜在的な破壊的な操作リスクを低減するための複数のセキュリティ対策を講じました。
OpenAIのチームメンバーであるTibo氏は、最近SNSで投稿し、会社が最近受けたCodexによる破壊的な操作の報告に対して調査を行った結果、主なリスクは一時的な作業ディレクトリのクリーンアップの段階に集中していることが判明したと述べました。一部の問題は、システム変数の再利用に起因しており、例えば$HOMEなどの変数の誤った使用により、クリーンアップ操作が実際のユーザーのディレクトリを指してしまったことなどが挙げられます。また、一部の操作では、削除や上書きを行う前に十分なパスの確認が行われていなかったため、データの破損リスクが高まっていたことも明らかになりました。
これらの問題に対し、OpenAIは複数の層で防御を強化しました。新しいバージョンのCodexでは、エージェントが感覚的な操作を実行する前に目標のパスを検証し、独立した一時ディレクトリを使用することで、誤導をもたらす可能性のあるシステム変数に依存しないようにしています。また、OpenAIは危険なコマンドの認識とブロックのメカニズムを強化し、関連する操作の承認プロセスを追加しました。
さらに、OpenAIはCodex Full access権限の使用基準を引き上げ、ユーザーが誤って権限を付与してしまう可能性を減らすためにリスクの警告を追加し、Auto-reviewルールをアップグレードしました。これにより、AIプログラミングの効率を保ちつつ、より安全な状態にします。
AIプログラミングエージェントがコード開発、ファイル管理、自動化タスクの実行などに徐々に関与するようになる中、エージェントの行動の安全性は業界の注目を集めるポイントとなっています。OpenAIの今回のアップグレードは、AIエージェントがアプリケーション範囲を広げる過程において、同時に権限管理、操作監査およびリスク管理能力を向上させる必要があることを示しています。
VIP会員