Superando la barrera de la escasez de datos: las personas sintéticas aceleran el desarrollo de IA en Japón
NTT DATA ha utilizado el conjunto de datos sintéticos Nemotron-Personas-Japan de NVIDIA, compuesto por 6 millones de personas basadas en la demografía, geografía y cultura japonesa, para superar la escasez de datos en el desarrollo de IA. Partiendo de solo 450 muestras iniciales, generaron más de 138.000 datos de entrenamiento, mejorando la precisión de un modelo del 15,3% al 79,3% en clasificación de documentos legales sin comprometer datos confidenciales. Este enfoque elimina alucinaciones, ahorra costes al evitar el preentrenamiento continuo y facilita la creación de modelos IA soberanos adaptados a Japón. Es especialmente relevante para empresas bajo regulaciones estrictas de privacidad como PIPA.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.