OpenAI presenta 'Jalapeño', su primer chip de inferencia de IA que supera a Nvidia Blackwell en varias pruebas
OpenAI ha presentado su primer chip de inferencia de IA, bautizado como 'Jalapeño', un acelerador diseñado para ejecutar modelos ya entrenados y generar las respuestas que reciben los usuarios de ChatGPT, la API o los agentes. Los analistas de SemiAnalysis han analizado el componente y concluyen que, en varias cargas de prueba, el chip supera a los procesadores Nvidia Blackwell en latencia y rendimiento por vatio. OpenAI asegura que puede lograr hasta 3,6 veces menos latencia y entre 1,5 y 1,9 veces más rendimiento por vatio que Blackwell, dependiendo del modelo y la configuración. El chip aún no está completamente optimizado, ya que no incorpora la técnica Multi-Token Prediction, y según los analistas su coste total de propiedad se acerca incluso a Vera Rubin, la próxima generación de chips de Nvidia. Jalapeño no está pensado para venderse: OpenAI lo usará en su propia infraestructura para reducir el coste por token y depender menos de Nvidia, que sigue dominando el entrenamiento de modelos gracias a su ecosistema CUDA.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.