Investigadores de ciberseguridad han identificado una nueva técnica de inyección de prompts llamada PuzzleMask, que oculta instrucciones contrarias a las políticas de seguridad dentro de textos de apariencia completamente normal, para sortear los controles de seguridad perimetrales en arquitecturas de inteligencia artificial (IA).
Con esta técnica los actores maliciosos pueden inyectar prompts maliciosos sin tener que recurrir a indicadores tradicionales como codificación Base64, caracteres invisibles, emojis u otro tipo de formatos inusuales, como era necesario hasta ahora, poniendo en peligro...