GROQ 3 LPX ENTRA EN PRODUCCIÓN TOTAL PARA IMPULSAR LA INFERENCIA EN… — Solo CEDEARs — TG.ME

📊GROQ 3 LPX ENTRA EN PRODUCCIÓN TOTAL PARA IMPULSAR LA INFERENCIA EN LA ARQUITECTURA VERA RUBIN

Nvidia ($NVDA) anunció la entrada en producción masiva de Groq 3 LPX, su acelerador de inferencia de ultra-baja latencia optimizado para integrarse con los sistemas Vera Rubin NVL72 y acelerar flujos de trabajo basados en agentes interactivos.

Puntos clave:
Rendimiento récor en inferencia: En las pruebas de benchmark de Artificial Analysis sobre el modelo Gemma 4 31B (con contexto de 100K tokens), alcanzó 3.400 tokens de salida por segundo, ofreciendo una respuesta hasta 4 veces más rápida que las alternativas vigentes en tareas dependientes de latencia.

Arquitectura híbrida y desacoplada: El diseño divide las tareas de inferencia asignando a las GPU Vera Rubin el procesamiento de contextos masivos (prefill), mientras que las LPU Groq 3 LPX ejecutan la generación rápida de tokens (decode).

Despliegue y adopción inicial: Nebius será el primer proveedor de nube en integrar esta tecnología a través de N
👍5
August 27, 2026 770 2 1