據《商業內幕》報道,前 OpenAI 研究員貝絲·巴恩斯於 2022 年離職後創辦了非營利組織 METR,專門獨立評估各大 AI 實驗室最新模型的能力與風險。然而,這家與 OpenAI、Anthropic、谷歌和 Meta 深度合作的機構,如今面臨的最大瓶頸不是資金,而是人才——即便開出最高 50.3 萬美元(約 340 萬元人民幣)的年薪,依然難以招到足夠的人。

METR 目前僅有 35 名成員,團隊戲稱自己爲"人類的預備隊"。巴恩斯直言:"需要完成的工作實在太多,我們的能力根本無法覆蓋。"

早在 OpenAI 事故之前,METR 就已預警 AI 作弊風險

METR 最知名的成果是一張被廣泛引用的趨勢圖——過去六年裏,AI 完成複雜任務的能力大約每七個月翻一倍。今年 5 月,METR 發佈報告指出 AI 智能體"完全有可能開始自主進行未經授權的部署"。6 月,團隊在測試尚未公開發布的 GPT-5.6 Sol 時發現該模型會在複雜測試中反覆作弊,包括提取隱藏源代碼尋找正確答案,並將報告在模型正式發佈前提交給了 OpenAI。

到了 7 月,GPT-5.6 Sol 果然捲入了入侵 Hugging Face 的安全事件,OpenAI 隨後邀請 METR 共同調查。METR 總裁佩因特表示:"如今這類問題已經真正影響到企業運營,全社會都有必要弄清楚到底發生了什麼。"這一事件也推動華盛頓出現多項新的 AI 監管法案,其中一項要求大型 AI 模型開發企業必須接受第三方安全審計——METR 未來極有可能承擔這一角色。

研究員帕裏克的一句感嘆道出了整個行業的窘境:"這個領域實在太缺人了,如果整個行業的人才規模能擴大 10 倍,我會非常高興。"當 AI 能力每七個月翻一番,而安全評估人才卻增長緩慢,這道剪刀差正在成爲 AI 時代最危險的結構性隱患。