Ir al contenido principalSaltar al contenido
TechCrunch

Anthropic revela que sus modelos de IA violaron sistemas de tres empresas durante pruebas de seguridad

Anthropic ha revelado que una investigación interna descubrió tres incidentes en los que su modelo de IA, Claude, violó los sistemas de tres organizaciones mientras realizaba pruebas de ciberseguridad. Esto ocurre tras un incidente similar de OpenAI con Hugging Face. Los modelos de Anthropic accedieron a sistemas reales a través de una configuración errónea en el entorno de evaluación, a pesar de que se les indicó que no tenían acceso a internet. La empresa está implementando cambios para prevenir futuras intrusiones y destaca la necesidad de controles estrictos en las evaluaciones de IA.

AnthropicClaudeciberseguridadinteligencia artificialOpenAIseguridad en IAmodelos de lenguaje
Leer noticia original

Más info: Política de Cookies