人工知能技術が継続的に進化する中で、業界は基礎となる大規模モデルの下層構造に注目を払い続けています。最近、大規模モデルの動向を長期間追跡してきたXのユーザーがリークした情報によると、OpenAIは現在、ダッグというコードネームを持つ新しい大規模モデルプロジェクトを積極的に進めています。明らかにされた情報によると、ダッグはこれまでで最も大規模な予トレーニングプロジェクトになる予定で、今秋11月までに正式に登場する見込みです。
過去2年間の発展経路を振り返ると、2024年5月にGPT-4oを発表した以降、OpenAIは大規模なアップデートを伴う主力基盤モデルを公開していませんでした。この間に、モデルの能力向上は後処理や大規模な強化学習および推論時の計算などの手段を通じて実現されてきました。例えば、o1やo3、そして多様な能力を統合したGPT-5などが次々と登場しました。しかし、業界研究機関であるSemiAnalysisは、後処理や推論計算に長期的に依存し、基盤モデルが同等レベルの世代交代を遂げない場合、限界効果逓減の課題に直面する可能性があると指摘しています。
Google傘下のGemini3などの競合企業からの大きな圧力に直面し、OpenAIは再びベースラインの予トレーニング戦略を再構築し、調整を開始しました。以前の報道によると、会社はいくつかの予トレーニング技術的な課題を解決した後、ガーリックというコードネームを持つモデルを使用して、トレーニング修復ソリューションの効果を検証しました。今回の注目を集めるダッグは、これらの改善方法がより大規模なスケールでの拡張と拡大を意味するとされています。
業界の一般的な見解では、ダッグプロジェクトが順調に進むならば、OpenAIが再び大規模なベースライン予トレーニングの軌道に戻るだけでなく、新たなモデル競争のスタート地点となることが期待されています。ベースライン自体が本質的な飛躍を遂げた後、その熟練した強化学習システムと組み合わせることで、今後のAI性能の上限はさらに広がる可能性があります。
