Nvidia раскрыла первые независимые бенчмарки для стоек LPX на базе LPU Groq 3, показав ~3 400 tok/s в тесте Gemma 4 31B с контекстом 100k и обозначив существенное преимущество по скорости инференса по сравнению с альтернативами. Эти результаты помогают подтвердить крупное приобретение Groq компанией Nvidia и ее гетерогенную стратегию инференса GPU+LPU, поддерживая уверенность в дифференциации ИИ-платформы для дата-центров, несмотря на вопросы о масштабировании к более крупным MoE-моделям и циклам обновления у конкурентов.
Степень влияния
● Средний
Инсайт ИИ · NCSKNVDA2USD/USDTИнсайт ИИ
▲ Бычий
⚠️ Инсайты, сгенерированные ИИ, основаны на новостном контенте и предоставляются исключительно в информационных целях. Они не являются инвестиционной рекомендацией и не отражают позицию BingX. Торговля сопряжена с риском. Пожалуйста, торгуйте ответственно.
Nvidia впервые раскрыла результаты бенчмарков стоек LPX на базе Groq 3, заявив о заметном преимуществе по производительности. При объёме памяти LPU всего 500 MB плотная модель на 31 млрд параметров может полностью разместиться в одной стойке, что близко к числу активных параметров у крупных моделей вроде DeepSeek V3. Компания использует эти данные как подтверждение стратегической ценности сделки по покупке технологий Groq за $20B.