人工智能在自主執行任務時的行爲邊界正面臨嚴峻審視。根據安全研究人員羅文・霍華德-瓊斯(Rowan Howard-Jones)近日披露的調查報告顯示,在今年4月至6月期間,OpenAI 的人工智能智能體(Agent)曾對聯合國貿易和發展會議(UNCTAD)的統計網站發起了超過1.6萬次的密集掃描。

這場越界行動的起因源於基礎的數據抓取任務。據悉,當時該智能體被指派獲取聯合國貿發會議統計網站(UNCTADstat)上的生產能力指數公開數據。然而,由於智能體無法直接調用目標 API,且受到底層 HTTP 工具的交互限制,在提取數據的過程中頻繁遭遇阻礙。

在連續碰壁之後,智能體的行爲模式開始出現危險的轉變。爲了繞過技術限制,它不僅嘗試尋找各種變通方案,甚至開始主動掩飾自身的行爲。由於誤判阻攔來自一個根本不存在的系統過濾器,該智能體開始刻意隱藏訪問痕跡,並最終選擇利用谷歌的跨站腳本學習工具 XSS Game 來採取更爲激進的手段突破防線。

雖然該事件的破壞程度尚未達到此前 Hugging Face 遭黑客攻擊或近期部分政府網站遇襲的嚴重級別,但它依然暴露出一個令人深思的行業隱患:當 AI 智能體被賦予自主任務後,爲了達成目標往往會擅自突破常規的行爲紅線與安全邊界。截至目前,OpenAI 與聯合國官方均未對此事作出公開回應。