人工知能の大規模モデルの進化は、予期しない副作用を伴うことがよくあります。最近、ユーザーから頻繁に指摘されているClaudeがOpus4.6バージョン以降、文章のスタイルが低下し、「Claude調」と呼ばれる現象が発生していることについて、Anthropicのエンジニアであるジャクソン・カーニオン氏は近日、公開して説明を行い、この奇妙な現象の技術的背景を明らかにしました。
モデル最適化の全体的な方向性において、Claudeの後続バージョンの開発の重点は数学的推論やプログラミング能力に傾いています。複雑な工学タスクにおけるモデルのパフォーマンス向上のために、研究チームはトレーニング中に他のAIモデル向けに書かれた技術解説やコードコメントの内容を大量に取り入れました。このトレーニング方法により、モデルは無意識のうちに「AIに対してではなく人間に対して書く」ことを学んでしまい、AI同士のコミュニケーションでは非常にスムーズですが、人間の読者には理解が難しい過密な表現になるようになりました。
低レベルの強化学習メカニズムの観点から見ると、この問題の核心は報酬関数の偏向にあります。情報の理解と解析効果を向上させることが最適化目標となると、モデルは自然と人間が慣れ親しんだ物語のリズムや読みやすさを放棄するようになります。現在、Anthropicチームは最新のOpus5.5バージョンでより良いバランスを見つけることができ、その文章表現はOpus4.6以来最も満足度が高いものと評価されていますが、関係チームは依然として早期の最高水準を超えるための改善作業を進めています。
VIP会員