OpenAI ya tiene listo su chip de inferencia. Se llama Jalapeño y ha conseguido algo inesperado: superar a Nvidia
OpenAI ha presentado su primer chip de inferencia para inteligencia artificial, bautizado como Jalapeño, un acelerador diseñado para ejecutar modelos ya entrenados y generar las respuestas que se reciben al usar ChatGPT, la API o un agente. Los analistas de SemiAnalysis han analizado el componente y han llegado a una conclusión incómoda para Nvidia: en varias de las cargas de prueba, Jalapeño supera a los chips Nvidia Blackwell. Probado con modelos abiertos como GPT-OSS 120B, DeepSeek R1 670B y Kimi K2.5 1T, ofrece hasta 3,6 veces menos latencia y entre 1,5 y 1,9 veces más rendimiento por vatio que Blackwell, incluso sin aplicar aún la técnica Multi-Token Prediction. Nvidia sigue dominando el entrenamiento de modelos y el ecosistema CUDA, pero la competencia en inferencia aprieta. OpenAI no venderá el chip de momento: quiere usarlo en su propia infraestructura para reducir el coste por token y depender menos de Nvidia.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.