Nvidias erste Groq-3-LPU-Benchmarks zeigen 3.400 Token/s und stützen die 20-Milliarden-Dollar-Wette
KI-Marktzusammenfassung
Nvidia veröffentlichte die ersten Benchmarks von Drittanbietern für Groq-3-LPU-basierte LPX-Racks und zeigte dabei ~3.400 tok/s in einem Gemma-4-31B-Test mit 100k-Kontext, wobei ein signifikanter Vorteil bei der Inferenzgeschwindigkeit gegenüber Alternativen herausgestellt wurde. Die Ergebnisse tragen dazu bei, Nvidias große Groq-Übernahme und seine heterogene GPU+LPU-Inferenzstrategie zu validieren, und stützen das Vertrauen in die Differenzierung der KI-Plattform für Rechenzentren trotz Fragen zur Skalierung auf größere MoE-Modelle und zu Erneuerungszyklen der Wettbewerber.
Einflussstufe
● Medium
Betroffene Assets
NCSKNVDA2USD/USDT-3.53%
AI-Einblick · NCSKNVDA2USD/USDTAI-Einblick
▲ Bullisch
Jetzt traden
⚠️ Die von AI generierten Einblicke basieren auf Nachrichteninhalten und dienen ausschließlich zu Informationszwecken. Sie stellen weder eine Anlageberatung dar noch geben sie die Ansichten von BingX wieder. Investitionen sind mit Risiken verbunden. Bitte trade verantwortungsbewusst.
Nvidia hat erstmals Benchmark-Ergebnisse für LPX-Racks auf Basis von Groq 3 veröffentlicht und dabei deutliche Performance-Vorteile ausgewiesen. Trotz nur 500 MB Speicher pro LPU kann ein dichtes Modell mit 31 Milliarden Parametern vollständig in einem einzelnen Rack untergebracht werden, was größenmäßig nahe an der Zahl aktiver Parameter großer Modelle wie DeepSeek V3 liegt. Damit unterstreicht das Unternehmen den strategischen Wert seiner 20-Milliarden-Dollar-Übernahme von Groq-Technologie.