El chip Jalapeño de OpenAI está diseñado para inferencia rápida a gran escala, según los benchmarks
En la conferencia Hot Chips del martes, OpenAI presentó un análisis más detallado de su nuevo chip Jalapeño, incluyendo los primeros resultados de benchmarks del sistema. Probado con el benchmark InferenceX de SemiAnalysis, Jalapeño registró más tokens por usuario y más rendimiento por kilovatio que los procesadores de inferencia de última generación actualmente disponibles. El responsable de hardware de OpenAI, Richard Ho, destacó un significativo avance de rendimiento sobre el estado del arte. El chip, desarrollado en estrecha colaboración con Broadcom, está diseñado para minimizar los retrasos durante las fases de prellenado y comunicación de la inferencia, que suelen actuar como cuellos de botella. Se espera su despliegue en pequeños volúmenes a finales de 2026 y un despliegue más significativo en 2027.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.