Nvidia publie les premiers tests de performances des racks LPX basés sur les LPU Groq 3 pour son pari de 20 milliards de dollars
Résumé du marché par IA
Nvidia a publié les premiers benchmarks tiers pour les racks LPX basés sur la LPU Groq 3, affichant ~3"400 tok/s sur un test Gemma 4 31B avec un contexte de 100k, et présentant un avantage matériel en vitesse d'inférence par rapport aux alternatives. Les résultats contribuent à valider la grande acquisition de Groq par Nvidia et sa stratégie d'inférence hétérogène GPU+LPU, soutenant la confiance dans la différenciation de la plateforme d'IA pour centres de données malgré les questions sur le passage à l'échelle vers des modèles MoE plus grands et les cycles de renouvellement des concurrents.
Niveau d'impact
● Moyen
Actifs concernés
NCSKNVDA2USD/USDT-2.93%
Infos de l'IA · NCSKNVDA2USD/USDTInfos de l'IA
▲ Haussier
Trader maintenant
⚠️ Les infos générées par l'IA sont basées sur des contenus d'actualité et fournies à titre informatif uniquement. Elles ne constituent pas des conseils en investissement et ne reflètent pas les positions de BingX. Investir comporte des risques. Tradez de manière responsable.
Nvidia a publié ses premiers résultats de benchmarks pour des racks LPX reposant sur les LPU Groq 3, mettant en avant un net gain de performance. Malgré seulement 500 MB de mémoire par LPU, un modèle dense de 31 milliards de paramètres comme Gemma 4 31B peut tenir dans un seul rack. Les chiffres cités indiquent 3,400 tok/s sur une séquence d’entrée de 100,000 tokens et une performance annoncée comme 4x supérieure à l’alternative la plus proche, selon Artificial Analysis. L’ensemble est présenté comme une validation du pari de 20 milliards de dollars de Nvidia sur la technologie LPU de Groq.