Los primeros resultados de Jalapeño muestran velocidad y eficiencia líderes en la inferencia de IA
OpenAI ha publicado los primeros resultados de Jalapeño, su primer chip de inferencia personalizado, tras semanas de pruebas del chip y del sistema construido a su alrededor. Los resultados muestran un avance significativo: Jalapeño es capaz de procesar más trabajo de IA por unidad de potencia a la vez que devuelve respuestas más rápidas, combinando mayor rendimiento y menor latencia en una única arquitectura, algo en lo que los sistemas de hardware existentes suelen tener que elegir entre ambos. En comparación con los sistemas de referencia, Jalapeño ofreció entre 1,5 y 1,9 veces más trabajo por vatio y una latencia de extremo a extremo entre 1,7 y 3,6 veces menor en modelos públicos como GPT-OSS 120B, DeepSeek R1 y Kimi K2.5 1T. El chip fue diseñado con la ayuda de la propia IA de OpenAI, que también aceleró su programación, y supone el inicio de una hoja de ruta multigeneracional. OpenAI planea comenzar a desplegar Jalapeño dentro de su infraestructura de cómputo a finales de año.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.