Ir al contenido principalSaltar al contenido
Hugging Face

Nemotron ColEmbed V2: Elevando el listón en recuperación multimodal con el mejor modelo de ViDoRe V3

NVIDIA presenta la familia Nemotron ColEmbed V2, modelos de embedding de interacción tardía en tamaños 3B, 4B y 8B para recuperación multimodal de alta precisión. Estos modelos ocupan los primeros puestos en el benchmark ViDoRe V3, superando a competidores en tareas de recuperación de documentos visuales complejos. Construidos sobre VLMs como Qwen3-VL y Llama-3.2, incorporan autoatención bidireccional y mecanismos ColBERT extendidos a multimodalidad. Destacan por mejoras en fusión de modelos y datos sintéticos multilingües, ideales para sistemas RAG en entornos empresariales donde la precisión prima sobre la eficiencia.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

Nemotron ColEmbed V2ViDoRe V3NVIDIArecuperación multimodalmodelos de embeddinginteracción tardíaRAG
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies