Guide Labs presenta un nuevo tipo de LLM interpretable
Guide Labs, una startup de San Francisco fundada por Julius Adebayo y Aya Abdelsalam Ismail, ha lanzado en código abierto Steerling-8B, un modelo de lenguaje grande de 8.000 millones de parámetros con una arquitectura innovadora que permite rastrear cada token generado hasta sus orígenes en los datos de entrenamiento. Esta interpretabilidad facilita entender el razonamiento del modelo en temas como hechos, humor o género, resolviendo problemas comunes en LLMs como alucinaciones o sesgos. El enfoque inserta una capa de conceptos para categorizar datos de forma trazable, utilizando otras IAs para anotación y logrando el 90% del rendimiento de modelos más grandes con menos datos. Guide Labs planea escalar a modelos mayores y ofrecer acceso vía API, destacando su utilidad en industrias reguladas como finanzas o ciencia, donde se necesita control preciso.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.