LightOnOCR-2-1B: una familia de modelos OCR end-to-end ligeros y de alto rendimiento
LightOn AI ha lanzado LightOnOCR-2-1B, su segunda generación de modelos de visión-lenguaje OCR end-to-end con 1 billón de parámetros, optimizados para convertir páginas de documentos en texto limpio sin pipelines multi-etapa. Este modelo alcanza el estado del arte en el benchmark OlmOCR-Bench, superando a Chandra-9B en más de 1,5 puntos porcentuales siendo 9 veces más pequeño y hasta 5 veces más rápido que competidores como DeepSeek-OCR o PaddleOCR-VL. Se liberan varias variantes, incluyendo con cajas delimitadoras para localización de imágenes, y checkpoints base para fine-tuning. Además, se publican datasets de anotaciones abiertos con más de 23 millones de páginas. Todo bajo licencia Apache 2.0 e integrable con Transformers de Hugging Face.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.