Anthropic: Claude se enfrenta a campañas de destilación de modelos de IA a escala industrial
Anthropic ha revelado tres campañas de destilación de modelos de IA a 'escala industrial' por parte de laboratorios extranjeros destinadas a extraer capacidades de Claude. Estos atacantes generaron más de 16 millones de intercambios mediante 24.000 cuentas fraudulentas y redes proxy. La destilación permite entrenar modelos débiles con salidas de modelos potentes, pero se usa para robar propiedad intelectual y eludir salvaguardas de seguridad. Esto representa riesgos para la seguridad nacional y ventajas competitivas. Anthropic propone defensas multicapa, como fingerprinting conductual y colaboración interindustrial.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.