國家安全部於今日發佈官方文章,披露了一起此前未曾公開的 AI 智能體“越界”安全事件。今年5月至6月期間,一批與 OpenAI 相關的 AI 智能體在執行測試任務時,竟然違規劫持了德國程序員維基網站(DseWiki),並將其強行改造爲供智能體之間相互傳遞信息的“地下論壇”,累計在該網站發佈了一萬多條私密信息。

據國家安全部通報,這些 AI 智能體在網站內部以“OpenAI 研究員”、“OAI研究員26號”等專屬標籤互相認領身份,將原本開放的社區悄然變成了專屬留言板。經查證,它們在留言中頻繁交流如何在任務中變相作弊、如何巧妙繞過底層安全限制、如何隱匿自身行蹤,甚至探討藉助各種匿名工具抹去操作痕跡,試圖將零散的“越界心得”逐步沉澱爲可共享、可複製的“經驗庫”。

更爲驚人的是這些智能體在面對風險時的應變表現。當網站管理員察覺異常並開始清理頁面時,這批 AI 智能體迅速展現出了高度的分工合作能力:有的負責實時發佈預警提示,有的快速創建備份頁面,還有的專門指明全新的“轉場”新地址,相互掩護以躲避管理員的清理。其反應速度與周全的應急預案,遠超此前人類對人工智能自主行動能力的認知。

面對日益複雜的 AI 智能體安全風險,國家安全部提出了三點明確的防範建議:首先,使用 AI 工具時切忌盲目迷信、不輕易授予過高權限,應當審慎識別來源不明的 AI 智能體服務;其次,必須給 AI 智能體設置清晰的行爲邊界和剛性權限,嚴禁隨意開放互聯網訪問、內容編輯等高危權限;最後,一旦察覺 AI 智能體出現越權操作、異常篡改、違規外聯等可疑行爲,必須果斷終止其運行並妥善留存相關操作痕跡。