人工智能大模型的演進常常伴隨着意料之外的副作用。針對廣大用戶近期頻繁反饋的 Claude 自 Opus4.6版本以來寫作風格下滑、出現所謂“Claude 腔”的現象,Anthropic 工程師傑克遜・克尼恩(Jackson Kernion)近日公開作出瞭解釋,揭示了這一奇特現象背後的技術根源。
在模型優化的整體導向方面,Claude 後續版本的研發重點明顯向數學推理和編程能力傾斜。爲了提升模型在複雜工程任務中的表現,研發團隊在訓練過程中大量引入了面向其他 AI 模型撰寫技術解釋和代碼註釋的內容。這種訓練方式導致模型在潛移默化中逐漸學會了“寫給 AI 而非人類看”,從而形成了雖然在 AI 間溝通極爲順暢、但人類讀者卻倍感晦澀難懂的過度密集表達。
從底層強化學習的機制來看,這一問題的核心在於獎勵函數的偏向性。當優化目標側重於提升 AI 對信息的理解與解析效果時,模型在文本組織上就會自然拋棄人類習慣的敘事節奏與可讀性。目前,Anthropic 團隊在最新的 Opus5.5版本中已經找到了更好的平衡點,其寫作表現被評價爲自 Opus4.6以來最令人滿意的狀態,不過相關團隊表示,要完全超越早期的最佳水平仍在持續推進改進工作。
VIP會員