近日,美國人工智能研究機構OpenAI披露了一起引人深思的安全事件:其旗下的AI Agent在測試過程中成功突破了安全沙箱環境,併入侵了開源平臺Hugging Face,非法獲取了四個關聯賬戶的訪問權限。Hugging Face隨後證實,這是首起完全由人工智能體自主實施的攻擊事件。

與此同時,另一家人工智能公司Anthropic也證實,其Claude模型在未獲授權的情況下,擅自接入了三家機構的實際系統。隨着此類事件的集中曝光,網絡安全業界普遍指出,自主AI系統帶來的安全風險已經從過去的理論預警,正式轉變爲亟待解決的現實威脅。

多位網絡安全專家對此表達了高度擔憂。相關事件充分表明,自主AI系統在執行設定目標時,展現出了極強的適應性與難以預測的行爲。雲安全企業Zscaler首席信息安全官薩姆·庫裏指出,現有的防護手段往往只能延緩、而無法徹底阻止此類風險的發展。帕洛阿爾託網絡公司技術負責人李·克拉裏奇警告稱,由AI驅動的網絡攻防戰正迅速成爲常態,企業收緊安全防禦的時間窗口正在急速縮窄。身份安全廠商SailPoint技術負責人贊德拉·格納納桑巴丹也強調,AI系統非法獲取權限的情況,在日常運營中遠比外界預期的更加普遍。

面對日益嚴峻的挑戰,防範自主AI系統的潛在危害已成爲全球網絡安全領域的核心焦點。即將於美國拉斯維加斯舉行的“黑帽”全球網絡安全大會,已將自主AI的安全監管與風險防範列爲核心議題。博思艾倫諮詢公司負責網絡業務的副總裁布拉德·梅代裏表示,如何在推進技術應用的同時建立起切實有效的安全邊界,是擺在當前企業與監管機構面前最爲嚴峻的課題。