Ataque mediante imágenes a modelos multimodales (Gemini) que puede filtrar datos
Investigadores han descrito un nuevo tipo de ataque que aprovecha las capacidades multimodales de modelos como Gemini. El método consiste en inyectar instrucciones ocultas dentro de imágenes; cuando estas imágenes son procesadas por un sistema de IA multimodal, las instrucciones pueden inducir al modelo a filtrar información o a ejecutar acciones no deseadas. El informe indica que la técnica podría aplicarse no solo a Gemini sino también a otros modelos capaces de interpretar contenido visual y textual de forma conjunta. Las consecuencias señaladas incluyen la exfiltración de datos sensibles desde el contexto donde se procesa la imagen y la ejecución de comportamientos fuera del control previsto por los desarrolladores. El texto original disponible en los datos proporcionados es un resumen informativo; no se dispone de más detalles técnicos ni de mitigaciones concretas en el material facilitado.
Transparencia: Este artículo ha sido generado con asistencia de inteligencia artificial bajo supervisión editorial de SAPIENSDATAAI.