Ir al contenido principalSaltar al contenido
Hugging Face

Mismo clúster, 33 puntos más de utilización: lo que cambió fue el orden

En un clúster de GPU idéntico y con las mismas cargas de trabajo, un asignador de GPU consciente de las restricciones superó a un programador FIFO, aumentando la utilización de la GPU hasta en 33 puntos porcentuales y la producción ponderada por prioridad hasta en un 105%. Este avance no se logró mediante cambios de hardware, sino optimizando el orden en que se toman las decisiones de asignación. El artículo explora los problemas del enfoque FIFO, especialmente en escenarios de contención y la gestión de la inferencia en tiempo real, y presenta una solución que optimiza la asignación de recursos a lo largo de un horizonte de 24 horas, reevaluando cada hora para ajustarse a los cambios y las predicciones de demanda.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

gestión de GPUutilización de GPUprogramación FIFOasignador de GPUinferencia en tiempo realDharma AIoptimización de recursos
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies