Машинное обучение RU: post #3506 — TG.ME

NVIDIA запустила Groq 3 LPX - отдельный ускоритель генерации токенов для платформы Vera Rubin

По данным NVIDIA, в бенчмарке Artificial Analysis система достигла 3400 output-токенов в секунду на Gemma 4 31B при контексте 100 000 токенов.

Компания называет это самым быстрым зафиксированным результатом для этой модели.

Также NVIDIA заявляет до 4x более быстрый отклик по сравнению с ближайшей альтернативной платформой - прежде всего для AI-агентов и других latency-sensitive нагрузок.

Первым облачным провайдером с Groq 3 LPX станет Nebius через Token Factory. Затем ускоритель появится и в инфраструктуре Groq.

https://x.com/nvidianewsroom/status/2091904293343252534
❤4👍4
August 24, 2026 1.6K 18