モデルを直接チップに溶接し、シリコンウェーフがアルゴリズムに計算力とデータ転送を節約する——グーグルはこの道を進み、コードネーム「Frozen v2」と呼ばれる新しいサーバーチップを静かに開発しています。複数のメディア報道によると、このチップはGeminiモデルをより効率的に動作させることが目的で、Geminiの一部の構造をチップに永久に埋め込むことで、ユーザーの質問に答える際の計算量とデータ移動量を減らす予定です。グーグルのエンジニアは、最新世代の汎用AIチップTPU(テンソルプロセッサ)と比較して、Frozenチップは単位電力あたりで6〜10倍のトークン処理能力を提供すると予測しています。

このチップの登場時期は2028年に設定されていますが、グーグルはこれは汎用的なTPUを置き換えるものではなく、カスタムチップ製品ラインの中でさらに専門的で特化した分野を担うものであることを明確にしています。情報が公表された後、市場は即座に反応しました:グーグルのAクラス株(GOOGL)は米国市場で早朝に3.7%近く上昇し、Cクラス株(GOOG)は最高で3.9%上昇しました。

メディアからの質問に対して、グーグルは声明で、会社のチームは継続的にさまざまな革新技術を研究・試験しており、ユーザーと顧客に最適なパフォーマンスと最高の効率を提供することを目指していると述べました。また、すべてのプロジェクトが量産に至るわけではないものの、このような厳格な探求こそが同社のフルスタック戦略の核心部分であると強調しました。グーグルはまた、ハードウェアとソフトウェアの下部から協調設計することで、システム全体が深く統合され、現実的なワークロードに対して高度に最適化されていると述べました。しかし、現在のところ、Frozen v2は試験的なプロジェクトとして位置づけられており、TPUのように大規模生産する計画はありません。

分析家の見解によると、このプロジェクトの背景には、グーグル内で深刻化する計算力の課題があります。以前の計算力不足は内部資源の競争を激化させ、一部の外部クライアントビジネスを拒否せざるを得なかったという話もあります。先月、グーグルはSpaceXに月額ほぼ10億ドルを支払うことで、計算力の穴を埋め、企業向けの計算力の約束を果たすことに合意しました。Frozen v2は明らかにこの穴を埋めるための一歩です。

アーキテクチャをチップに固定することで、柔軟性は縮小します。報道では、グーグルの今後のGeminiモデルが同じ基本構造を引き続き使用する限り、このチップは後続バージョンと互換性があるとされていますが、モデルの基本構造が大幅に変更された場合、その設計は機能しなくなる可能性があります。そしてチップよりもっと急務なのは、グーグルのAIビジネスが直面している連続する挑戦です:次世代のGemini Proの公開日が延期されたという噂があり、また多くのベテランのAI研究者が競合企業へ移っています。専用チップが2028年のロードマップの中にありながら、グーグルがまず安定させなければならないのは現在のモデルのペースと人材防衛です。