Ir al contenido principalSaltar al contenido
HuggingFace

nvidia/LocateAnything-3B — modelo grounding/object-detection trending (956 likes)

Modelo NVIDIA 3B image-text-to-text para grounding y deteccion de objetos por lenguaje. Candidato para OCR/vision en RAG documental (planos, catastro AYBAR). 61K descargas.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

nvidiavisiongroundingocr
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies