Nvidia объявила на Hot Chips 2026 о запуске в серийное производство… — БлоGнот — TG.ME

Nvidia объявила на Hot Chips 2026 о запуске в серийное производство Groq 3 LPX — специализированного ускорителя инференса, дополняющего платформу Vera Rubin. В стойке NVL72 может работать до 256 таких ускорителей. По данным Artificial Analysis, система выдаёт 3 400 токенов в секунду на модели Gemma 4 31B с контекстом в 100 тысяч токенов. Первым клиентом стал облачный провайдер Nebius, также Nvidia назвала SpaceX новым флагманским заказчиком платформы Vera Rubin.

Это вот такой результат необычной сделки, когда Nvidia получила лицензию на Groq и трудоустроила около 20 ведущих сотрудников компании у себя, включая основателя. Сам результат тоже неплох — для сравнения, на Cerebras эта же Gemma выдает вдвое меньшую скорость.

https://siliconangle.com/2026/08/24/nvidias-dedicated-inference-accelerator-groq-3-lpx-enters-full-production-to-supercharge-ai-agents/
SiliconANGLE
Nvidia’s dedicated inference accelerator Groq 3 LPX enters full production to supercharge AI agents
Nvidia's dedicated inference accelerator Groq 3 LPX enters full production to supercharge AI agents - SiliconANGLE
🔥15👍3
August 25, 2026 4.9K 20