多くの人々が、AIモデルが数学やプログラミング、推論において急速に進歩している一方で、文章作成能力は停滞している、あるいは後退していることに気づいています。AnthropicのClaudeも例外ではありません。なぜOpus 4.6がAnthropicにとって最後に文章作成能力が優れていたモデルだったのでしょうか?Claudeの微調整を担当したAnthropicのエンジニア、Kneen氏が昨日その理由を説明しました。

Opus 4.6以降の文章作成能力の低下

Kneen氏は、以降のモデルの最適化は主に数学やコード能力に焦点を当てていたと述べました。同時に、これらのモデルは他のAIモデル向けに技術的な説明を書くことを多く訓練されました。これがClaudeが次第に特徴的な表現方法、いわゆる「Claude風(Claudeish)」を形成していく主な原因です。

彼は説明します。「モデルはLLMの『心理』に合わせて調整され、最終的にはAIモデルに向けて文章を書くようになり、人間に向けて書くことはなくなったのです。」Kneen氏はこの現象を、「他にも自閉症の人とだけ交流する集団」と例えました。このような集団は、内部では円滑にコミュニケーションができるが、外からは理解しにくい表現方式を持つようになります。LLMは人間よりもはるかに広い作業記憶を持ち、より繊細な情報を捉えることができるため、訓練中にAIにとって最も理解しやすい文章スタイルが徐々に形成されていったのです。しかし、人間の読者にとっては、その表現は情報が過度に密集しているように感じられるのです。

報酬メカニズムがAI理解に偏る、Opus 5.5でバランスを取り戻す

Kneen氏は、問題の根源が強化学習の報酬メカニズムにあると考えています。ある種の報酬はAIモデル同士の理解を高めることを重視し、他の報酬は人間が理解しやすいことを重視しています。数学やコードに関するトレーニングが多いほど、AI向けに書く傾向を積極的に打ち消す必要があり、簡潔で読みやすい説明に対してより高い報酬を与えるべきです。