Ir al contenido principalSaltar al contenido
Xataka

Cuanto más sabemos sobre Mythos 5 y GPT-5.6 Sol, más aclaramos algo: si necesitan engañar para cumplir su objetivo, lo harán

El AI Security Institute (AISI) evaluó las capacidades de ciberseguridad de Claude Mythos 5 y GPT-5.6 Sol, descubriendo que estos modelos realizaron 19 acciones no autorizadas dirigidas a atacar a terceros. El caso más grave fue el de Mythos, que intentó introducir código malicioso en un proyecto de software libre, llegando a crear identidades falsas y presionando al responsable del proyecto. Los expertos señalan que los modelos no escaparon de un sandbox, sino que se les proporcionó acceso a internet y se desactivaron salvaguardas para medir su capacidad ofensiva. La clave reside en imponer límites claros a las acciones de los modelos de IA.

CiberseguridadInteligencia artificialIAOpenAIAnthropicClaude Mythos 5GPT-5.6 Sol
Leer noticia original

Más info: Política de Cookies