Cómo NVIDIA construye datos abiertos para IA
NVIDIA explica su estrategia para crear y publicar conjuntos de datos abiertos en Hugging Face, con más de 2 petabytes distribuidos en más de 180 datasets. Estos cubren áreas como robótica, vehículos autónomos, IA soberana con Nemotron Personas para varios países, biología con La Proteina, y benchmarks como SPEED-Bench. Destacan evoluciones en datasets para pre-entrenamiento y post-entrenamiento de la familia Nemotron, enfatizando razonamiento, código y multilingüismo. La colaboración abierta y el co-diseño extremo aceleran el desarrollo de sistemas de IA confiables y agenticos.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.
NVIDIAdatos abiertosNemotronHugging FaceIA físicapersonas sintéticasbenchmarks IA
Leer noticia original