Ir al contenido principalSaltar al contenido
AI News

La escalabilidad de la IA agentiva requiere una nueva arquitectura de memoria

La IA agentiva marca una evolución de los chatbots sin estado hacia flujos de trabajo complejos, pero su escalado enfrenta cuellos de botella en la memoria debido al crecimiento del caché KV. NVIDIA introduce la plataforma Inference Context Memory Storage (ICMS) en su arquitectura Rubin, que añade un nuevo nivel de almacenamiento flash (G3.5) conectado por Ethernet para manejar eficientemente contextos largos. Esta solución, integrada con BlueField-4 y Spectrum-X, permite retener grandes volúmenes de memoria sin saturar la HBM de las GPU, multiplicando por cinco el rendimiento y la eficiencia energética. Proveedores como Dell, HPE e IBM ya desarrollan compatibilidad para su despliegue en la segunda mitad del año.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

IA agentivaNVIDIAarquitectura de memoriainfraestructuramemoria KVagentes AIICMS
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies