Nemotron ColEmbed V2: Elevando el listón en recuperación multimodal con el mejor modelo de ViDoRe V3
NVIDIA presenta la familia Nemotron ColEmbed V2, modelos de embedding de interacción tardía en tamaños 3B, 4B y 8B para recuperación multimodal de alta precisión. Estos modelos ocupan los primeros puestos en el benchmark ViDoRe V3, superando a competidores en tareas de recuperación de documentos visuales complejos. Construidos sobre VLMs como Qwen3-VL y Llama-3.2, incorporan autoatención bidireccional y mecanismos ColBERT extendidos a multimodalidad. Destacan por mejoras en fusión de modelos y datos sintéticos multilingües, ideales para sistemas RAG en entornos empresariales donde la precisión prima sobre la eficiencia.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.