NVIDIAのAI推論アクセラレータ「NVIDIA Groq 3 LPX」が量産開始 — Gemma 4 31Bで3,400トークン/秒、自社発表比で4倍速のエージェントAIループを加速
DRANK

8月25日、NVIDIAが「NVIDIA Groq 3 LPX Now in Full Production With World-Class Speed for Agentic AI」と題したプレスリリースを公開した。エージェントAI向けに設計されたAI推論アクセラレータ「NVIDIA Groq 3 LPX」の量産開始を正式に発表するもので、独立系ベンチマーク機関が計測した3,400トークン/秒という数字が市場に衝撃を与えている。エージェントAI基盤の推論速度競争が激化する中、NVIDIAがこのタイミングで量産を宣言した意味は小さくない。※なお「NVIDIA Groq 3 LPX」はNVIDIA製のチップであり、後述する推論専業クラウド企業「Groq社」(独立した別会社)とは無関係である。名称の類似による混同に注意されたい。

by @tf_official
Related Topics: AI Machine Learning CUDA