Nvidiaは、約200億ドルで買収したGroqの技術をベースに開発した推論特化型アクセラレータ「Groq 3 LPX」が量産段階に入ったと発表した。Groq 3 LPXは単体の製品ではなく、Nvidiaの次世代GPUプラットフォーム「Vera Rubin NVL72」と組み合わせて使うラックスケールのシステムとして設計されている。役割分担としては、Rubin側のGPUが処理負荷の大きいコンテキスト処理(プロンプトの読み込みなど)を担当し、Groq 3 LPXは応答速度が重視されるデコード(トークン生成)処理を専門に受け持つ構成になっている。
第三者機関Artificial Analysisによるベンチマークでは、オープンモデル「Gemma 4 31B」を用いた検証で、10万トークンという長いコンテキストを扱う条件下で毎秒3400トークンの出力速度を記録したという。Nvidiaはこの数値について、比較対象とした他の選択肢に対して4倍の速さに相当すると説明している。エージェントが複数の処理を連続してこなす「エージェント型AI」のワークロードでは応答速度の遅延がそのままユーザー体験の悪化につながるため、こうした推論特化型ハードウェアの重要性が増しているとNvidiaは位置付けている。
Groq 3 LPXの発表は、半導体業界の技術カンファレンス「Hot Chips 2026」に合わせて行われた。初期の採用企業としてはNebius、CoreWeave、SpaceXAIの名が挙げられている。NvidiaはGPU単体の性能向上だけでなく、推論に特化した専用チップをラック単位で組み合わせることで、データセンター全体としてのエージェント処理能力を底上げする戦略を進めている。
出典: NVIDIA Newsroom



