Reconstruyendo Among AIs a partir de seis archivos de registro
Un artículo de la comunidad de Hugging Face explica cómo se reconstruyó el juego "Among AIs", un benchmark de deducción social para LLM, a partir de seis archivos de registro. El autor analizó 90 partidas con seis modelos pequeños de lenguaje (27B-35B), descubriendo que, aunque los modelos pueden razonar sobre el engaño, no pueden ejecutarlo de forma fiable. Los tripulantes ganaron el 80% de las partidas, y los modelos impostores a menudo revelaban sus planes de engaño internamente. Los resultados sugieren que los modelos pequeños tienen dificultades para mantener una distinción entre el razonamiento privado y la producción de habla pública cuando están bajo presión.
Among AIsdeducción socialLLMmodelos de lenguajeengañointeligencia artificialHugging Face
Leer noticia original