Ir al contenido principalSaltar al contenido
Hugging Face

Nemotron 3 Nano 4B: Un modelo híbrido compacto para IA local eficiente

NVIDIA ha lanzado Nemotron 3 Nano 4B, un modelo de lenguaje compacto de 4.000 millones de parámetros basado en arquitectura híbrida Mamba-Transformer, diseñado para despliegues eficientes en dispositivos edge como Jetson y GPUs RTX. Este modelo, prunado y destilado de Nemotron Nano 9B v2 mediante el framework Nemotron Elastic, destaca por su rendimiento state-of-the-art en seguimiento de instrucciones, uso de herramientas, baja latencia y mínimo uso de VRAM. Se ofrece en versiones BF16, FP8 y GGUF para optimizar la inferencia en escenarios locales, promoviendo privacidad de datos y bajos costes. Como modelo open-source, permite personalización y fine-tuning para casos específicos.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

Nemotron 3 Nano 4BNVIDIAMamba-TransformerNemotron ElasticJetsoncuantizaciónIA en edge
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies