AI獨角獸 Anthropic 於2026年10月8日正式更新其模型使用政策,明確禁止利用其旗艦 AI 模型 Claude 進行選舉干預、武器軟件開發及大規模監控行爲,並首次將“對模型進行持續言語辱罵”列入禁令範圍。
此次調整是在其8月上線防濫用機制後的進一步制度化保障,旨在全面劃定安全紅線,防範生成式 AI 對民主進程的潛在威脅。

新版政策設立了名爲“不得破壞民主進程”的專章,全面禁止用戶利用 Claude 實施生成虛假新聞媒體、運營假賬號等大規模欺騙活動,以及任何誘導選民或干預選舉的行爲。
值得關注的是,針對人機交互中的極端情況,政策新增了終止惡意的長時段辱罵性對話的條款。官方補充說明強調,該限制僅適用於極少數的持續無故濫用場景,正常的意見批評、學術測試、研究分析及暗黑創意創作等均不在受限範圍內。
作爲始終強調“AI安全性”的企業,Anthropic 此前不僅聯合宗教學者探索模型意識與倫理等前沿課題,其最新招股書也詳細披露了高額虧損與業務增長情況,並警示了 AI 技術可能帶來的系統性風險。
隨着生成式 AI 深步融入社會基礎設施,本次政策更新不僅提升了模型對抗惡意利用的防禦機制,也爲大模型行業的合規化治理與人機交互倫理樹立了新的參考標杆。
VIP會員