Ir al contenido principalSaltar al contenido
Hugging Face

Reconstruyendo Among AIs a partir de seis archivos de registro

Un artículo de la comunidad de Hugging Face explica cómo se reconstruyó el juego "Among AIs", un benchmark de deducción social para LLM, a partir de seis archivos de registro. El autor analizó 90 partidas con seis modelos pequeños de lenguaje (27B-35B), descubriendo que, aunque los modelos pueden razonar sobre el engaño, no pueden ejecutarlo de forma fiable. Los tripulantes ganaron el 80% de las partidas, y los modelos impostores a menudo revelaban sus planes de engaño internamente. Los resultados sugieren que los modelos pequeños tienen dificultades para mantener una distinción entre el razonamiento privado y la producción de habla pública cuando están bajo presión.

Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.

Among AIsdeducción socialLLMmodelos de lenguajeengañointeligencia artificialHugging Face
Leer noticia original
Cookies esenciales

Necesarias para el funcionamiento del sitio. No se pueden desactivar.

Cookies analíticas

Nos permiten medir el tráfico y mejorar el sitio (Google Analytics).

Más info: Política de Cookies