nvidia/LocateAnything-3B — modelo grounding/object-detection trending (956 likes)
Modelo NVIDIA 3B image-text-to-text para grounding y deteccion de objetos por lenguaje. Candidato para OCR/vision en RAG documental (planos, catastro AYBAR). 61K descargas.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.
nvidiavisiongroundingocr
Leer noticia original