SynthVision: Construyendo un dataset sintético de 110K para VQA médica con validación cruzada de modelos
OpenMed, en colaboración con Hugging Face y Doubleword, ha creado SynthVision, un dataset sintético de 110.000 registros para Visual Question Answering (VQA) médica. Se generó anotando 119.000 imágenes médicas con dos VLMs frontier (Qwen 3.5 y Kimi K2.5), validando cruzadamente al 93% de acuerdo para filtrar alucinaciones. El fine-tuning de modelos pequeños de 2-3B parámetros mejora todos los benchmarks evaluados, con ganancias promedio de hasta +15% en exact match. Todo el proceso costó menos de 500 dólares y se ha open-sourced completamente: datasets, código y adaptadores.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.
SynthVisionVQA médicadataset sintéticovalidación cruzadaQwen 3.5Kimi K2.5fine-tuning
Leer noticia original