El chip Jalapeño de OpenAI está diseñado para una inferencia rápida a gran escala, según los benchmarks
OpenAI ha presentado en la conferencia Hot Chips los primeros resultados de benchmarks de su chip Jalapeño, un procesador diseñado para acelerar la inferencia de modelos de IA a gran escala. En las pruebas realizadas con el benchmark InferenceX de SemiAnalysis, el chip registró más tokens por usuario y más rendimiento por kilovatio que los procesadores de inferencia disponibles actualmente, incluido el sistema Nvidia Blackwell. Según Richard Ho, responsable de hardware de OpenAI, Jalapeño supone una mejora significativa frente al estado del arte, ya que puede servir más trabajo de IA por unidad de energía y con menor latencia. El chip, desarrollado en colaboración con Broadcom y con asistencia de los propios modelos de OpenAI, se desplegará en volúmenes muy pequeños a finales de 2026 y de forma más amplia en 2027. La compañía planea convertirlo en una plataforma multigeneracional que integre productos, modelos, chips y memoria, minimizando los cuellos de botella en las fases de prefill y comunicación de la inferencia.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.