あなたの国または地域を選択してください

NVIDIAは、200億ドルの技術契約に続いてGroq 3 LPXラックの本格的な生産を開始しました

8月24日月曜日、NVIDIAはGroq 3 LPXラックスケールシステムが本格的な生産に入ったことを発表しました。これは、昨年の200億ドルに関連するGroq取引を通じて得た技術の商業展開を示すものです。低遅延AIエージェント推論向けに設計されたこのシステムは、Vera Rubinプラットフォームの一部となり、トークン生成中のGPUの性能制約に対処します。

NVIDIAのシニアディレクターであるディオン・ハリスは、最初のGroq 3 LPXラックがクラウドサービスプロバイダーNebiusのプラットフォームに展開されると述べました。Vera CPUとRubin GPUと組み合わせることで、2026年後半にサービスを開始する予定の完全な異種コンピューティングクラスタを形成します。

各LPXラックは256のGroq 3言語処理ユニット、またはLPUを統合しています。このシステムは、大量のオンチップSRAMを使用して外部メモリへのアクセスに伴うオーバーヘッドを減少させ、AIエージェントやAI支援プログラミングなど、長いコンテキストウィンドウと高速応答時間を要求する推論ワークロードに最適化されています。公式のベンチマーク結果によると、ラックはGemma 4 31Bモデルを100,000トークンのコンテキストウィンドウで実行する際に、毎秒3,400の出力トークンを提供し、遅延に敏感なワークロードで明確な性能上の利点を持ちます。

NVIDIAとGroqは2025年12月に200億ドルの合意に達しました。この取引に基づき、NVIDIAはGroqのチップアーキテクチャ技術に対するライセンスを確保し、Groqの創設チームおよびコアエンジニアリング人員を会社に取り込みました。これは、NVIDIAの歴史の中で最大の技術取引でした。Groqは独立した会社として残り、その既存のクラウドビジネスは運営を続けました。合意前に、Groqはオープンソースの大規模言語モデルで使用される低遅延LPU推論技術に対して業界の注目を集めていました。

Vera Rubinプラットフォームは、分散型の異種推論アーキテクチャを採用しています。Rubin GPUはモデルの事前充填操作と大規模なコンテキスト処理を担当し、Groq 3 LPXシステムはデコーディング段階での高速トークン生成に集中します。Vera CPUはツール呼び出しやコード実行などの汎用ワークロードを実行します。このワークロードの分担により、異なるプロセッサがそれぞれの強みに応じてAIエージェントのワークフロー全体をサポートできるようになります。

チップ製造の取り決めも供給チェーン全体の違いを反映しています。GroqシリーズのLPUはサムスンによって製造されている一方、NVIDIAのメインストリームGPUはTSMCの製造能力を使って生産されています。