Superando la barrera de la 'falta de datos': Las personas sintéticas aceleran el desarrollo de IA en Japón
NTT DATA ha utilizado el dataset sintético abierto Nemotron-Personas-Japan de NVIDIA para superar la escasez crónica de datos en el desarrollo de modelos de IA adaptados a Japón. Partiendo de solo 450 muestras de semilla, generaron más de 138.000 datos sintéticos, elevando la precisión de un modelo en tareas legales del 15,3% al 79,3% sin comprometer datos sensibles. Este avance demuestra cómo los datos sintéticos permiten entrenamientos eficientes, preservan la privacidad y aceleran la innovación en IA soberana, evitando procesos costosos como el aprendizaje continuo previo. NTT DATA destaca su potencial en dominios como soporte al cliente o marketing, alineándose con regulaciones japonesas de privacidad.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.