OpenAI生產線深處正在發生一件令人脊背發涼的事:內部的AI模型已經能夠自主接管實驗性AI模型的訓練全流程。多個智能體自發協作完成相關工作,把原本漫長的實驗耗時大幅壓縮,甚至還能自己動手編寫用於優化GPU內核的程序——在OpenAI看來,這正是遞歸式自我提升(RSI)的雛形。

面對這股正在加速的勢頭,OpenAI拋出了全球安全倡議。公司明確指出,全自主的RSI尚未真正發生,但進程正在提速;一旦缺乏管控,人類有可能徹底失去對AI發展的實際控制。爲此它呼籲建立針對前沿AI模型的全球統一技術標準,把幾件最要緊的事寫進規則:評估AI在自動化研發中的佔比、設置強制人類監督的觸發機制、確立事故的分類與報告規範。倡議還提出由美國主導相關進程,目標很明確,就是讓安全對齊研究的速度始終跑在AI能力提升的前頭。

更務實的一步是互相盯防。OpenAI正與曾因安全理念分歧出走的Anthropic敲定一份協議,雙方交叉測試對方的商用模型,用互查來補上自審的盲區,共同應對RSI逼近帶來的未知風險。當造AI的AI開始自己迭代自己,連最激進的玩家也意識到,靠一家企業關起門來自我審查,已經撐不住這道防線了。