Nvidia estrena un chip pensado solo para que los agentes de IA respondan sin esperas
Nvidia pone en producción el Groq 3 LPX, un chip dedicado a acelerar la respuesta de los agentes de IA. Nace de su compra del talento de Groq y ya tiene primer cliente comercial.


Las claves
- Nvidia anunció el 24 de agosto, en la conferencia Hot Chips, que su chip Groq 3 LPX ha entrado en producción completa.
- Es un acelerador especializado solo en la fase de "decodificación" —generar la respuesta token a token—, el cuello de botella que hace que un agente de IA se sienta lento al usar herramientas o razonar en varios pasos.
- Nebius, un proveedor de nube de IA, es el primer cliente comercial confirmado; el chip procede de la adquisición del talento de la startup Groq por unos 20.000 millones de dólares.
Nvidia anunció el 24 de agosto, durante la conferencia técnica Hot Chips, que su chip Groq 3 LPX ha entrado en producción a plena escala. Se trata de un acelerador diseñado con un propósito muy concreto: no entrenar modelos ni procesar grandes cantidades de contexto, sino acelerar específicamente la generación de la respuesta, token a token, en los sistemas de IA que actúan como agentes.
El problema que resuelve
Para entender por qué importa, conviene distinguir dos fases del trabajo de un modelo de IA. La primera es procesar todo el contexto de entrada —leer la pregunta, el historial, los documentos—, una tarea para la que las GPU tradicionales de Nvidia rinden muy bien. La segunda es generar la respuesta, palabra por palabra, y ahí es donde aparece el problema: un agente de IA que razona, usa herramientas y encadena varios pasos genera enormes cantidades de esos tokens de respuesta, y cualquier retraso en cada uno de ellos se multiplica a lo largo de la cadena completa de la tarea. Es la diferencia entre un asistente que responde al instante y uno que se siente torpe. El Groq 3 LPX se especializa exclusivamente en esa segunda fase, trabajando junto a las GPU de la plataforma Vera Rubin de Nvidia, no en su lugar.
De dónde viene la tecnología
El chip nace de la adquisición del talento de Groq, la startup especializada en chips de inferencia de baja latencia que Nvidia se llevó por unos 20.000 millones de dólares —la operación que ya cubrimos en su día, y que sigue el mismo patrón que semanas después repitió con la startup Poolside: quedarse con la tecnología y el equipo sin una compra formal—. Con el grueso del talento de Groq ya integrado en Nvidia, la promoción del producto ha pasado a manos de la propia compañía. Según sus cifras, un rack completo puede combinar hasta 256 de estos aceleradores, y la decodificación de contexto largo sería hasta cuatro veces más rápida que los servicios públicos actuales. Nebius, un proveedor de nube especializado en IA, es el primer cliente comercial confirmado.
Lo que conviene mirar con cautela
Como con cualquier anuncio de rendimiento, las cifras —los "cuatro veces más rápido" o las comparativas de rendimiento frente a la generación anterior— son de la propia Nvidia, medidas en sus propias condiciones, y aún sin verificación independiente amplia. Conviene además situar el anuncio en su contexto comercial: Nvidia lleva meses fragmentando su oferta en piezas cada vez más especializadas —GPU para entrenamiento, CPU propia (Vera), ahora un chip solo para decodificación—, una estrategia que profundiza la dependencia de todo el ecosistema de IA de un único proveedor con presencia en cada capa de la infraestructura. Para una empresa que contrate servicios de IA a través de la nube, el efecto práctico llegará indirectamente: si estos chips cumplen lo prometido, los asistentes y agentes que uses deberían sentirse más rápidos con el tiempo, aunque el ritmo real de esa mejora dependerá de qué proveedores de nube adopten la tecnología, no solo de que Nvidia la fabrique.
Fuentes
Enlaces a las fuentes originales en las que se apoya esta noticia. Contrasta cada dato en su origen.
- NVIDIA Newsroom (nota oficial)nvidianews.nvidia.com
- SiliconANGLEsiliconangle.com
- ServeTheHome (análisis técnico independiente)servethehome.com
Preguntas frecuentes
- ¿Qué es el Groq 3 LPX y en qué se diferencia de una GPU normal de Nvidia?
- Es un chip especializado solo en generar la respuesta de un modelo de IA, token a token, mientras que las GPU de Nvidia se ocupan de procesar el contexto de entrada. Trabaja junto a las GPU, no en su lugar, y está pensado específicamente para que los agentes de IA respondan más rápido en tareas de varios pasos.
- ¿Tiene esto algo que ver con la startup Groq?
- Sí. El chip surge del talento y la tecnología que Nvidia se llevó al adquirir Groq por unos 20.000 millones de dólares, mediante una fórmula de licencia y contratación de personal similar a la que usó después con la startup Poolside.
- ¿Cuándo notará un usuario normal la diferencia?
- De forma indirecta y con el tiempo. El chip ya está en producción y Nebius es su primer cliente comercial, pero el efecto en los asistentes o agentes de IA que usa una empresa dependerá de si los proveedores de nube que utiliza adoptan esta tecnología en su infraestructura.

GonzaloFundador
Madrileño enganchado a la tecnología desde pequeño. Trabajo en finanzas pero la inteligencia artificial es lo que me quita el sueño. Creé Miuranews para seguirla de cerca y contarla en español sin hype.
Todos sus artículos →◈ Asistente Miuranews
Pregunta sobre este artículo
Respuestas basadas en esta pieza y en el archivo de Miuranews. Sin inventar: si no está cubierto, te lo dice.
Prueba una
Experimento en beta · No sustituye a la lectura del artículo
Sigue leyendo
- ○ EmpresasQué puedes y qué NO puedes pegar en ChatGPT: guía RGPD
- ○ EmpresasAnthropic negocia la mayor compra de su historia: 6.000-7.000 millones por una startup israelí que abarata el cómputo
- ○ EmpresasSolo 15 de las 189 organizaciones que han firmado el código de transparencia de la IA son españolas