Перші бенчмарки Nvidia для LPX на базі Groq 3 показали 3,400 tok/s у ставці на $20B
Nvidia розкрила перші сторонні бенчмарки для LPX-стійок на базі LPU Groq 3, продемонструвавши ~3"400 tok/s у тесті Gemma 4 31B з контекстом 100k і позиціонуючи суттєву перевагу за швидкістю інференсу порівняно з альтернативами. Результати допомагають підтвердити велике придбання Groq компанією Nvidia та її гетерогенну стратегію інференсу GPU+LPU, підтримуючи впевненість у диференціації платформи ШІ для дата-центрів попри питання щодо масштабування до більших моделей MoE та циклів оновлення конкурентів.
Інсайт ШІ · NCSKNVDA2USD/USDTІнсайт ШІ
▲ Бичачий
⚠️ Інсайти, згенеровані ШІ, ґрунтуються на новинних матеріалах і надаються виключно з інформаційною метою. Вони не є інвестиційною порадою та не відображають поглядів BingX. Інвестування пов’язане з ризиком. Будь ласка, торгуйте відповідально.
Nvidia вперше оприлюднила результати бенчмарків стійок LPX на базі Groq 3, які вказують на суттєвий приріст продуктивності. Пам’ять одного LPU становить лише 500 MB, однак щільну модель на 31B параметрів можна повністю розмістити в межах однієї стійки, що наближається до масштабу активних параметрів у великих моделей на кшталт DeepSeek V3. Компанія розглядає ці результати як підтвердження стратегічної логіки своєї угоди на $20B щодо технологій Groq.