Ir al contenido principalSaltar al contenido
AI News

La infraestructura de NVIDIA y Google reduce los costes de inferencia de IA

En la conferencia Google Cloud Next, Google y NVIDIA han presentado su hoja de ruta de hardware para reducir los costes de inferencia de IA a gran escala. Han introducido las instancias A5X bare-metal basadas en sistemas NVIDIA Vera Rubin NVL72, que ofrecen hasta diez veces menor coste por token y mayor rendimiento por megavatio. Estas soluciones abordan desafíos como el ancho de banda masivo, la escalabilidad hasta 960.000 GPUs y la gobernanza de datos soberanos. Además, facilitan el entrenamiento de IA agentic y simulaciones físicas para industrias como la manufactura. Esta colaboración optimiza el rendimiento, el coste y la sostenibilidad para cargas de trabajo avanzadas.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

NVIDIAGoogle Cloudinferencia IABlackwellagentic AIIA físicarobotics
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies