El acelerador de inferencia Groq 3 LPX de NVIDIA entra en producción masiva

2026-08-25 14:22
Favoritos

es.wedoany.com Noticia: El 24 de agosto, NVIDIA anunció en la conferencia Hot Chips 2026 que su acelerador Groq 3 LPX, diseñado específicamente para la inferencia de agentes de IA, ha entrado en la fase de producción masiva, lo que marca la comercialización oficial del primer producto tras la adquisición de la licencia de tecnología de chips de Groq por 20 000 millones de dólares en diciembre de 2025.

El Groq 3 LPX es el acelerador de inferencia especializado de la plataforma de datos Vera Rubin de NVIDIA, centrado en la etapa de "decodificación" de la inferencia de IA, es decir, el eslabón clave que determina la velocidad de generación de tokens. Un solo rack LPX integra 256 aceleradores Groq 3 LPU, equipado con 128 GB de SRAM en chip y 640 TB/s de ancho de banda de expansión entre chips, adoptando la arquitectura de rack MGX de NVIDIA con refrigeración totalmente líquida. El chip es fabricado por Samsung Electronics, lo que crea una diferenciación en la cadena de suministro frente a las GPU de NVIDIA (fabricadas por TSMC).

En las pruebas de referencia de la organización independiente Artificial Analysis, el Groq 3 LPX, al ejecutar el modelo de código abierto Gemma 4 31B con un contexto largo de 100 000 tokens, logró una velocidad de generación de 3 400 tokens de salida por segundo, lo que NVIDIA califica como el rendimiento de inferencia más rápido registrado para ese modelo, siendo 4 veces más rápido que las plataformas competidoras en tareas sensibles a la latencia.

El proveedor de servicios de IA en la nube Nebius ha firmado un contrato para convertirse en el primer cliente de despliegue del Groq 3 LPX, y ofrecerá a los desarrolladores la capacidad de generación ultrarrápida de tokens de este acelerador a través de la plataforma de inferencia Nebius Token Factory. Dion Harris, director sénior de NVIDIA, afirmó que los racks Groq se desplegarán junto con las unidades centrales de procesamiento Vera y las unidades de procesamiento gráfico Rubin en Nebius, y se espera que estén oficialmente en línea en la segunda mitad de 2026. El director de tecnología de Nebius, Danila Shtan, declaró: "La generación es la fase de inferencia que determina la velocidad de respuesta de los sistemas de IA, y es precisamente lo que acelera el Groq 3 LPX."

El fundador y director ejecutivo de NVIDIA, Jensen Huang, afirmó que la plataforma Vera Rubin, mediante el Groq 3 LPX, ha logrado una configuración optimizada de fábricas de cómputo para la era de los agentes de IA, "lo que cambia la forma en que se produce la inteligencia, logrando otro gran salto en el rendimiento, la eficiencia y la velocidad de respuesta de la IA".

Harris enfatizó que el Groq 3 LPX no pretende reemplazar a las GPU, sino utilizar el procesador óptimo para cargas de trabajo específicas: las GPU siguen asumiendo el entrenamiento de modelos y la inferencia de propósito general, mientras que los chips Groq se centran en la etapa de "decodificación" sensible a la latencia. NVIDIA también anunció que SpaceX ha firmado un contrato para convertirse en el último cliente insignia de la plataforma Vera Rubin, desplegando CPU Vera para tareas de orquestación y simulación intensivas en CPU en centros de datos terrestres y satélites en órbita. Los envíos del sistema Vera Rubin se están acelerando, y dicho sistema inició su producción a principios de 2026.

Este boletín es una compilación y reproducción de información de Internet global y socios estratégicos, y está destinado únicamente a proporcionar a los lectores la comunicación. Si hay infracción u otros problemas, por favor infórmenos a tiempo, este sitio será modificado o eliminado. Toda reproducción de este artículo sin autorización formal está estrictamente prohibida. Correo electrónico: news@wedoany.com