La salting textual desafía a la IA: phishings evaden filtros y ponen en jaque la detección automática
Introducción
La inteligencia artificial (IA) y los modelos de lenguaje de gran tamaño (LLM), como GPT-4 y similares, se han convertido en herramientas clave en la detección de amenazas y la protección frente a campañas de phishing. Sin embargo, recientes investigaciones han puesto de manifiesto que técnicas clásicas como el “text salting” o salting textual, que consiste en modificar intencionadamente los textos para evadir la detección automática, están logrando eludir con éxito los sistemas de filtrado alimentados por IA. Esta vulnerabilidad en las defensas automatizadas facilita que correos electrónicos maliciosos lleguen sin obstáculos a las bandejas de entrada corporativas y personales, elevando el riesgo de incidentes de seguridad.
Contexto del Incidente o Vulnerabilidad
A medida que las soluciones antiphishing han evolucionado, los atacantes han adaptado sus tácticas. Tradicionalmente, los filtros antispam y antiphishing se basaban en reglas estáticas, listas negras y análisis heurístico. Con la irrupción de los LLMs, se esperaba una mejora sustancial en la detección gracias a su capacidad de comprensión semántica y contextual. Sin embargo, los ciberdelincuentes han comenzado a explotar limitaciones inherentes a estos modelos mediante el salting textual: la inserción de caracteres invisibles, sustituciones de caracteres Unicode, espacios irregulares o símbolos aparentemente inofensivos dentro de las palabras clave utilizadas en ataques de phishing.
Detalles Técnicos
El salting textual manipula las cadenas de texto en los mensajes de phishing para que sean legibles para el usuario, pero difíciles de interpretar para los sistemas automatizados basados en IA. Por ejemplo, un atacante puede reemplazar letras por otros caracteres visualmente similares (homoglyphs), insertar espacios en blanco de longitud cero (zero-width spaces), o fragmentar palabras clave como “contraseña” o “verificar cuenta” de manera que los modelos de lenguaje no las reconozcan.
Aunque no existe un CVE específico asociado a esta técnica, sí se relaciona con tácticas de “obfuscation” y “evasion” identificadas en el framework MITRE ATT&CK bajo las técnicas T1027 (Obfuscated Files or Information) y T1566 (Phishing). Los indicadores de compromiso (IoC) asociados incluyen cadenas de texto con caracteres Unicode sospechosos, patrones irregulares de espaciado y secuencias codificadas.
Entre los exploits conocidos, se han observado scripts automatizados en Python y PowerShell, así como módulos específicos para Metasploit que permiten generar campañas de phishing con salting textual. Los atacantes también hacen uso de frameworks como Cobalt Strike para desplegar cargas maliciosas tras la primera brecha.
Impacto y Riesgos
El impacto de esta técnica es significativo: estudios recientes estiman que hasta un 34% de los correos phishing que emplean salting textual consiguen evadir los filtros basados en IA, frente al 7% de los mensajes sin manipulación. Empresas del sector financiero, sanitario y administración pública se han visto especialmente afectadas, con incidentes que han supuesto pérdidas económicas superiores a los 25 millones de euros solo en Europa en el primer semestre de 2024.
Esta evasión puede conducir a robo de credenciales, compromiso de cuentas corporativas (Business Email Compromise, BEC), y exfiltración de datos sensibles, poniendo en riesgo el cumplimiento de regulaciones como el GDPR y la próxima NIS2.
Medidas de Mitigación y Recomendaciones
Para contrarrestar el salting textual, los expertos recomiendan:
– Implementar soluciones de análisis estático y dinámico que examinen la estructura del texto, identificando patrones de obfuscation y caracteres no estándar.
– Actualizar los modelos de IA y LLM con datasets que incluyan ejemplos de salting textual, mejorando su capacidad de generalización y detección.
– Utilizar herramientas de preprocesamiento que normalicen el texto antes del análisis, eliminando espacios invisibles y sustituyendo homoglyphs por sus equivalentes estándar.
– Realizar formación continua a los empleados para identificar intentos de phishing con textos alterados.
– Integrar soluciones de Threat Intelligence que compartan IoCs relacionados con técnicas emergentes de evasión.
Opinión de Expertos
Diversos analistas de ciberseguridad coinciden en que el reto principal reside en la adaptación continua de los modelos de IA. “La IA actual está entrenada sobre grandes volúmenes de texto ‘limpio’, pero los atacantes innovan constantemente. Sin datasets actualizados y procesos de normalización, la evasión es cada vez más sencilla”, señala Pablo Rodríguez, analista jefe de un conocido SOC europeo. Añade que “los LLMs son potentes, pero sufre limitaciones cuando el texto se aleja del ‘estándar’, lo que exige una combinación de tecnologías y lógica de negocio”.
Implicaciones para Empresas y Usuarios
El uso extendido de salting textual supone un desafío directo para la seguridad del correo electrónico corporativo y personal. Las organizaciones deben revisar sus políticas de filtrado, reforzar la capacitación de usuarios y actualizar sus sistemas de defensa para mantener el cumplimiento normativo (GDPR, NIS2). Para los usuarios finales, el riesgo de caer en fraudes aumenta, ya que los mensajes maliciosos logran mimetizarse con mayor eficacia.
Conclusiones
El salting textual representa una amenaza real y creciente en el panorama del phishing. La confianza ciega en las soluciones basadas exclusivamente en IA o LLMs puede resultar peligrosa si no se acompaña de una supervisión continua y medidas adicionales de preprocesamiento y threat intelligence. Las organizaciones deben anticiparse y adaptar sus defensas para no quedar expuestas ante técnicas que, aunque sencillas, demuestran ser altamente eficaces frente a las tecnologías más avanzadas de detección automática.
(Fuente: www.darkreading.com)
