Ir al contenido principalSaltar al contenido
Hugging Face

Nemotron 3 Nano 4B: Un modelo híbrido compacto para IA local eficiente

NVIDIA presenta Nemotron 3 Nano 4B, el modelo más compacto de la familia Nemotron 3 con 4.000 millones de parámetros, basado en una arquitectura híbrida Mamba-Transformer. Optimizado para despliegues en dispositivos edge como Jetson Orin Nano, DGX Spark y GPUs RTX, ofrece bajo consumo de VRAM, baja latencia y rendimiento state-of-the-art en seguimiento de instrucciones, inteligencia en juegos y uso de herramientas. Fue prunado y destilado de Nemotron Nano 9B v2 mediante el framework Nemotron Elastic, con post-entrenamiento adicional para razonamiento y seguridad. Disponible en código abierto en Hugging Face en formatos BF16, FP8 y GGUF, facilita la personalización y despliegues eficientes en IA local.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

Nemotron 3 Nano 4BNVIDIANemotron ElasticMamba-TransformerIA en edgeJetsoncuantización
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies