Nemotron 3 Nano 4B: Un modelo híbrido compacto para IA local eficiente
NVIDIA presenta Nemotron 3 Nano 4B, el modelo más compacto de la familia Nemotron 3 con 4.000 millones de parámetros, basado en una arquitectura híbrida Mamba-Transformer. Optimizado para despliegues en dispositivos edge como Jetson Orin Nano, DGX Spark y GPUs RTX, ofrece bajo consumo de VRAM, baja latencia y rendimiento state-of-the-art en seguimiento de instrucciones, inteligencia en juegos y uso de herramientas. Fue prunado y destilado de Nemotron Nano 9B v2 mediante el framework Nemotron Elastic, con post-entrenamiento adicional para razonamiento y seguridad. Disponible en código abierto en Hugging Face en formatos BF16, FP8 y GGUF, facilita la personalización y despliegues eficientes en IA local.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.