2026年8月、Nvidiaは256基のGroq推論チップを搭載するラックの初顧客としてNebiusを指名した。NvidiaはGroqの設計をライセンスしたが、Groqは独立を維持し、自社設備を構築する計画だった。

要点

  • NvidiaのGroq 3 LPXラックは、256基のGroq 3 LPU、128GBのオンチップSRAM、40 PBpsのSRAM帯域幅を搭載する。
  • Nvidiaは2026年8月、LPXの初顧客としてNebiusを指名した。
  • GroqはNvidiaとの契約後に$650 millionを調達し、2027年末までに200MWの設備容量を目標に掲げた。
  • 報じられたNvidia–Groq間の契約は、買収の発表ではなく、およそ$20 billionの非独占ライセンス契約だった。
  • Nvidiaは、100,000トークンの入力シーケンスを用いたGemma 4 31Bで、LPXが毎秒3,400トークンを記録したと報告した。

提供する処理によって有利なシリコンは異なる

2025年3月、Financial Timesは、推論向け設備投資が2026年に$208.2 billionへ達し、2年以内にトレーニング向け支出を上回るとするBarclaysの予測を報じた。これは予測であり、2026年の実績合計ではない。チップメーカーがすべての推論リクエストを縮小版のトレーニングワークロードとして扱うのではなく、特定の提供処理を念頭に設計を始めた背景の一端を示している。

Prefillは受信したプロンプトを処理し、decodeは応答を生成する。SemiAnalysisは、NvidiaのRubin CPXについて、メモリ帯域幅より演算スループットを優先し、prefill向けに最適化されていると説明した。SRAMを多く使うGroqのアプローチは、別のトレードオフを取る。モデル設計もハードウェア要件を変える。GoogleのGemma 3とCohereのCommand Aは、1基または2基のH100で動作すると報じられた。提供用ハードウェアを選ぶ買い手は、チップ速度の主張が意味を持つ前に、モデル、プロンプト、レイテンシー目標を定めなければならない。

Nvidiaは設計をライセンスし、その開発者を迎え入れた

The Informationは2025年12月、およそ$20 billion規模のNvidia–Groqライセンス契約を報じた。Groqはこの契約を非独占だと説明し、独立して事業を続けるとした。CEOのJonathan Rossなど幹部はNvidiaに加わった。これによりNvidiaは、Groqの買収を発表せずに、推論アーキテクチャと、それを製品に仕立てる方法を知る人材の両方を得た。

2026年3月、NvidiaはGroq 3 LPXを発表した。256基のGroq 3 LPU、128GBのオンチップSRAM、40 PBpsのSRAM帯域幅を搭載するラックである。NvidiaはこれをGPUプラットフォームの代替ではなく、Vera Rubin NVL72ラックと並ぶ製品として位置付けた。Nvidiaが顧客に提示したのは、自社名を冠した構成済みシステムだった。

Groqの遅れは、速度より供給を優先課題にした

Groqはすでに、速い設計と提供可能な設備容量の差に直面していた。2025年7月、The Informationは、データセンター容量の遅れを理由に、Groqが同年の売上高予測を下方修正し、$2 billion超から$500 million超へ引き下げたと報じた。いずれも実際の売上高ではないが、この修正はチップ性能だけでは解消できない制約を浮き彫りにした。

2026年8月、NvidiaはLPXが量産段階に入ったと発表し、初顧客としてNebiusを指名した。Nvidiaはまた、Gemma 4 31Bと100,000トークンの入力シーケンスを使ったArtificial Analysisのベンチマークで、毎秒3,400トークンを記録したと報告した。Nvidiaが報告したのは、1つのモデルとプロンプトにおける結果であり、GPU導入との比較でLPXのトークン当たりコスト、消費電力、稼働率を示したものではない。公開記録からは、誰がLPXの価格を決め、ラックを割り当て、顧客を適格と判断するのかも分からない。

他の開発企業は提供に向けて別の道を選んでいる

AMDは、モデルの重みをシリコンに直接統合する設計のTaalasを買収した。初期デモでは最大毎秒17,000トークンと報じられた。一方OpenAIは、GPT-5.6 Solで最大毎秒750出力トークンと報告し、Cerebras搭載のUltrafast API tierをプレビューした。AMDは設計を買収し、OpenAIは専門ハードウェアをサービスとして提供し、NvidiaはライセンスしたLPUをラックに搭載した。これらの速度指標は異なるワークロードを示すものであり、3つの製品を実現経済性で順位付けすることはできない。

特化には限界もある。完全にエージェント化されたワークロードの分析では、各応答を待つ人がいないアプリケーションでは、超低レイテンシーの価値が低くなる可能性があると論じた。別のトークン当たりドルの比較では、選定した推論指標においてNvidiaがTPU v6eとAMD MI300Xを上回った。どちらの結果も専門チップを排除するものではない。しかし、最も速いと公表された出力速度よりも、買い手のワークロードと運用コストを重要にする。

「非独占」は販売の境界を開いたままにする

GroqはNvidiaとの契約後、自社データセンター事業を拡大するため$650 millionを調達し、2027年末までに200MWの容量を目指すとした。この計画容量により、GroqはLPXとは別の顧客獲得経路を持つ可能性がある。これはライセンスを完全な商業的吸収とみなすことへの反証になる。ただし、資金調達ラウンドと目標だけでは、Groqがどれだけの容量を提供できるかは分からない。

Justice Departmentは、Groq取引においてNvidiaが反トラスト審査を回避しようとしたかどうかを調査していたと報じられた。調査は認定ではない。ただ、非開示の商業条件を重要なものにする。顧客や競合は、「非独占」という言葉だけから、各社を通じたGroqベース推論のLPX供給、価格、アクセスを誰が支配するのかを判断できない。

よくある質問

Nvidia Groq 3 LPXはいつ提供開始予定だったのか?

CRNの2026年3月の報道では、LPXは2026年後半に提供開始となる予定だった。その後Nvidiaは、2026年8月に量産段階へ入ったと発表した。

Groqの200MW目標は何を測るものか?

これはデータセンターの電力容量目標であり、チップ数や保証された顧客向けスループットの数値ではない。Groqは2027年末までにこの容量に達することを目指すとした。

NvidiaはGroqを完全買収したのか?

この記事が扱う範囲では、買収は発表されていない。Groqはこの取り決めを非独占と説明し、独立を維持するとした。また、GroqCloudは運営を継続すると述べた。

LPXシステムの購入・運用について、何が依然として不明なのか?

公開記録では、LPXの価格、ラックの割り当て、顧客の適格性判断、トークン当たりコスト、消費電力、GPU導入に対する稼働率が開示されていない。こうした情報の欠落により、報じられた速度ベンチマークだけから実現経済性を比較することはできない。

Groq–Nvidiaの商業化における主な節目

  • March 2025 — Financial Timesは、推論向け設備投資が2026年に$208.2 billionへ達するとのBarclaysの予測を報じた。
  • July 2025 — The Informationは、データセンター容量の遅れを理由に、Groqが2025年の売上高予測を$2 billion超から$500 million超へ下方修正したと報じた。
  • December 2025 — The Informationは、およそ$20 billion規模のNvidia–Groqライセンス契約を報じた。
  • March 2026 — Nvidiaは、256基のGroq 3 LPU、128GBのオンチップSRAM、40 PBpsのSRAM帯域幅を搭載するGroq 3 LPXラックを発表した。
  • August 2026 — NvidiaはLPXが量産段階に入ったと発表し、初顧客としてNebiusを指名した。
  • End of 2027 — Groqは自社データセンター容量200MWを目指すとした。

Groqが自社の提供容量に資金を投じ、それを販売できるなら、このライセンスは顧客に同社アーキテクチャへの2つの経路を残す。NvidiaだけがLPXを大規模に供給・サポートできるなら、顧客は主にNvidiaを通じてこのアーキテクチャに触れることになる。境界を示すのはライセンスの呼び名ではなく、発注書である。