TradingKey - Nvidia (NVDA) gab am Montag bekannt, dass das auf Groq-Technologie basierende NVIDIA Groq 3 LPX in die volle Serienproduktion gegangen ist und entsprechende Racksysteme noch in diesem Jahr an den Start gehen sollen. Als entscheidende Komponente der Vera-Rubin-Plattform zielt das Groq 3 LPX hauptsächlich auf den schnell wachsenden Markt für KI-Inferenz ab und verfeinert Nvidias Computing-Aufstellung vom KI-Modelltraining bis zum praktischen Einsatz weiter.
Nach von Nvidia veröffentlichten Informationen enthält jedes Groq-3-LPX-Rack 256 Groq-3-LPUs. Nvidia gab an, dass die Kombination von Groq 3 LPX mit Vera Rubin bei bestimmten Inferenzaufgaben großer KI-Modelle den Inferenzdurchsatz pro Megawatt um bis zu etwa das 35-Fache steigern kann, während zugleich die Arbeitslast erhöht wird, die KI-Rechenzentren unter denselben Strombedingungen verarbeiten können.
Ende 2025 unterzeichnete Nvidia eine nicht-exklusive Technologielizenzvereinbarung mit Groq und holte Groq-Gründer Jonathan Ross sowie mehrere Kernteammitglieder an Bord. Groq selbst bleibt weiterhin unabhängig tätig und baut sein GroqCloud-Geschäft weiter aus. Im August dieses Jahres wurde Groq offiziell ein Nvidia Cloud Partner.
Unterdessen beschleunigt Groq selbst die Einführung von Nvidias neuer Plattform. Das Unternehmen gab am 24. August bekannt, dass es zu den ersten Cloud-Service-Providern gehören wird, die NVIDIA Groq 3 LPX und Vera Rubin NVL72 auf den Markt bringen. Zusammen mit Nvidias Bestätigung, dass Groq 3 LPX in die volle Serienproduktion gegangen ist, deutet dies darauf hin, dass die Zusammenarbeit zwischen beiden Seiten schrittweise von der Technologielizenzierung zur Produktumsetzung und kommerziellen Bereitstellung übergegangen ist.
Für Nvidia liegt die Bedeutung des diesjährigen Starts von Groq 3 LPX darin, seine Wettbewerbsfähigkeit auf dem Markt für KI-Inferenz weiter zu stärken. In der Vergangenheit wurde die Nachfrage nach KI-Rechenleistung hauptsächlich durch das Training großer Modelle getrieben; da sich jedoch die Nutzerbasis von ChatGPT, Claude und verschiedenen KI-Agenten vergrößert, wächst die durch den täglichen Modellbetrieb erzeugte Inferenznachfrage rasant. Nvidia baut Vera Rubin daher von einer reinen GPU-Plattform zu einer vollständigen KI-Infrastruktur aus, die GPUs, CPUs, Groq-LPUs, Netzwerktechnik und Speicher umfasst.
Mit dem Eintritt von Groq 3 LPX in die volle Serienproduktion und dem geplanten Marktstart in diesem Jahr tritt die Partnerschaft zwischen Nvidia und Groq offiziell in die Kommerzialisierungsphase ein. Sollte sich der Schwerpunkt des Rechenwachstums in der nächsten Phase der KI-Branche weiter vom „Trainieren von Modellen“ hin zum „Ausführen von Modellen“ verlagern, wird die latenzarme Inferenztechnologie von Groq als wichtige Ergänzung für Nvidia dienen, um seine Marktabdeckung bei KI-Chips zu erweitern.