GoogleがGeminiのアーキテクチャをシリコンに直接焼き込む専用チップ「Frozen v2」を開発中 — TPU比最大6〜10倍の推論効率、2028年展開へ
DRANK

7月21日、The Decoderが「Google's "Frozen v2" chip reportedly bakes Gemini's architecture directly into silicon for efficiency gains」と題した記事を公開した。GoogleがGeminiモデルのアーキテクチャをシリコンに直接焼き込む専用チップ「Frozen v2」を社内開発しており、現行TPU比で最大6〜10倍の推論効率を実現する可能性があるという。推論コストが収益の生死を分けるAI業界において、これはGoogleの競争戦略の核心に触れる動きだ。

by @tf_official
Related Topics: AI Machine Learning Google Cloud