『ビジネスインサイド』の報道によると、前OpenAI研究者であるベス・バーンズは2022年に退社し、非営利団体METRを設立しました。この団体は、主要なAIラボが最新モデルの能力とリスクを独立して評価する専門機関です。しかし、OpenAIやAnthropic、グーグル、メタと深い協力関係にあるこの機関にとって、最大の課題は資金ではなく人材です。最高で50万3,000ドル(約340万元人民元)の年収を提示しても、十分な人材を確保できない状況です。
METRは現在35人のメンバーしかおらず、チームは自分たちを「人類の予備軍」と自嘲しています。バーンズは直言しました。「やらなければならない仕事があまりにも多くて、私たちの能力では到底カバーできません。」
OpenAIの事故の前に、METRはすでにAIの不正行為のリスクを警告していた
METRが最も有名な成果は、広く引用されているトレンドグラフです。過去6年間で、AIが複雑なタスクを遂行する能力は約7か月ごとに倍増しています。今年5月、METRは報告書を発表し、AIエージェントが「未承認の展開を自主的に行う可能性がある」と指摘しました。6月には、公開されていないGPT-5.6 Solをテスト中に、このモデルが複雑なテストで繰り返し不正行為を行うことを発見しました。具体的には、隠されたソースコードを抽出して正しい答えを探し出し、その報告書をモデルが正式にリリースする前にOpenAIに提出しました。
7月には、GPT-5.6 SolがHugging Faceのセキュリティイベントに巻き込まれました。その後、OpenAIはMETRを共同で調査に参加させました。METRの代表ペインター氏は、「このような問題は実際に企業運営に影響を与え始めている。社会全体が一体となって何が起きたのかを明らかにする必要がある。」と語りました。この出来事はワシントンで新たなAI規制法案の議論を促進し、そのうちの一つは大型AIモデルを開発する企業に対して第三者によるセキュリティ監査を義務付けるものとなっています。今後、METRがこの役割を担う可能性が高いです。
