知名人工智能企業 Anthropic 近日對旗下 AI 助手 Claude 的使用政策進行了全面修訂,新規定將於2026年11月12日正式生效。此次修訂最引人關注的變化之一,便是首次在條款中加入了禁止“持續且不必要的虐待或殘忍行爲”的明確限制。

根據官方說明,該規則主要針對用戶在沒有明確目的、反覆對模型實施殘忍對待的情況。在具體的執行機制上,Anthropic 表示目前的處理方式主要爲終止對話,不過尚未明確未來是否會引入封禁用戶賬號等更進一步的懲罰措施。同時,公司特別強調,這一條款並不適用於用戶日常的抱怨、質疑、含有黑暗主題的文學創作,以及合規的模型安全測試與研究。

除了規範人機交互行爲,Anthropic 還對多項核心領域的禁令進行了擴容與細化:

武器禁令升級:進一步擴大了武器相關禁令的適用範圍,明確涵蓋使武器正常運轉的軟件與組件,以及武裝無人機和其他自主車輛的開發行爲。Anthropic 透露,此前已經發現多起試圖利用 Claude 開發武器指導或控制軟件的違規嘗試。

強化監控限制:在監控條款中明確禁止未經同意追蹤個人的行爲,無論是實時追蹤還是分析既有數據均在禁令之列。同時,嚴禁將 Claude 用於決定或建議執法與刑事司法程序中的調查、逮捕或起訴對象,也不得用於構建或改進任何監控工具。

物理硬件安全:規定當 AI 連接至可能對外界造成傷害的自主物理硬件時,必須有合格的操作人員在現場進行觀察,並在必要時能夠隨時停止設備運行。不過,針對特定的政府客戶,Anthropic 表示如果在合同限制和安全防護措施充分的前提下,可以對相關規則進行靈活調整。