FINAL Bench: El verdadero cuello de botella para la AGI es la autocorrección
FINAL Bench presenta el primer benchmark funcional de metacognición, evaluando 9 modelos SOTA en 100 tareas expertas distribuidas en 15 dominios. Los resultados revelan que la autocorrección (Error Recovery) explica el 94,8% de las mejoras obtenidas con andamios metacognitivos, destacando una brecha declarativa-procedimental donde los modelos reconocen errores pero no los corrigen. Las tareas más difíciles se benefician más de estos mecanismos. Este hallazgo posiciona la metacognición como el principal obstáculo hacia la AGI, con implicaciones para la seguridad de la IA. El dataset está disponible abiertamente en Hugging Face.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.