Inside Nvidia’s Granary: un millón de horas de datos de voz para IA
Nvidia ha lanzado Granary, un conjunto de datos de voz de código abierto que contiene un millón de horas de audio multilingüe en 25 idiomas y se publica junto a dos modelos de inteligencia artificial. El artículo describe la iniciativa como un recurso para investigación y desarrollo en reconocimiento y síntesis de voz, subrayando la escala del dataset (1 millón de horas) y su carácter abierto, así como la disponibilidad de modelos asociados.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.
Nvidia Granarydataset de vozun millón de horasmultilingüemodelos de IAvoz sintetizada
Leer noticia original