Ir al contenido principalSaltar al contenido
Hugging Face

FINAL Bench: El verdadero cuello de botella para la AGI es la autocorrección

FINAL Bench presenta el primer benchmark funcional de metacognición, evaluando 9 modelos SOTA en 100 tareas expertas distribuidas en 15 dominios. Los resultados revelan que la autocorrección (Error Recovery) explica el 94,8% de las mejoras obtenidas con andamios metacognitivos, destacando una brecha declarativa-procedimental donde los modelos reconocen errores pero no los corrigen. Las tareas más difíciles se benefician más de estos mecanismos. Este hallazgo posiciona la metacognición como el principal obstáculo hacia la AGI, con implicaciones para la seguridad de la IA. El dataset está disponible abiertamente en Hugging Face.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

FINAL BenchmetacogniciónautocorrecciónError RecoveryAGIbenchmarks IAmodelos de lenguaje
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies