AMD×Cerebrasが「処理フェーズごとに別チップ」でAI推論を高速化 — NvidiaのGPU一択に挑む分離型アーキテクチャ
DRANK

7月24日、AMDが「AMD and Cerebras Announce Industry-Leading Ultra-Low-Latency and High Throughput AI Inference Solution」と題したプレスリリースを公開した。AMDとCerebras Systemsが超低遅延・高スループットAI推論ソリューションの共同開発を発表したものだ。NvidiaへのオルタナティブとしてAMD×Cerebrasが組むAI推論インフラ市場でNvidiaが圧倒的なシェアを持つ中、AMDとCerebras Systemsは2026年7月23日(現地時間)、「Advancing AI 2026」カンファレンスで技術提携を発表した。両社の狙いは、単純なGPUクラスタでは対応しにくくなってきた超低遅延かつ高スループットという二律背反の要求を、アーキテクチャレベルで解決することにある。「分離型推論(Disaggregated Inference)」という構成今回の発表の核心は、AMD Helios™とCerebras Wafer-Scale Engine(WSE)を1つの推論...

by @tf_official
Related Topics: AI Machine Learning CUDA