Resumen:
Una tecnología sigilosa que originalmente era famosa por el jailbreak de inteligencia artificial y los ataques rápidos de inyección de palabras - "Contrabando ASCII" - ahora ha sido objeto de abuso a gran escala en actividades de spam y phishing. El equipo de investigación de seguridad de Microsoft reveló que los ciberatacantes están utilizando este método para eludir las principales puertas de enlace de correo electrónico y los sistemas antispam y entregar mensajes fraudulentos a millones de buzones de correo.

El principio básico del "contrabando de ASCII" es utilizar caracteres Unicode especiales que son invisibles o no representados por el ojo humano en los estándares de codificación de texto modernos para incrustar información oculta en texto aparentemente normal. El método del que se abusa más comúnmente es el "bloque de etiquetas" Unicode (el rango de codificación es U+E0000 a U+E007F). Este bloque fue diseñado originalmente para el marcado de lenguaje y ahora está en gran medida abandonado. Contiene "imágenes de sombra" de caracteres ASCII imprimibles estándar (por ejemplo, U+E0041 corresponde a la letra A mayúscula). Cuando son vistos por el ojo humano o por la mayoría de las interfaces convencionales, estos personajes son completamente invisibles y no muestran ningún contenido visual; sin embargo, el software de análisis subyacente y el modelo de lenguaje grande de inteligencia artificial aún pueden reconocer y procesar estos textos ocultos al leer el flujo de caracteres original. Anteriormente, los piratas informáticos solían utilizar este mecanismo para "contrabandear" secretamente instrucciones maliciosas en el proceso de procesamiento de la IA, induciendo al asistente de la IA a filtrar datos privados o realizar operaciones no autorizadas sin el conocimiento del usuario.

Sin embargo, cuando el equipo de investigación de Microsoft estaba desarrollando una biblioteca de firmas de protección de inyección rápida de palabras para su sistema Defender para Office 365, detectó accidentalmente la aplicación encubierta de esta arma de ataque de IA en el fraude en línea tradicional. Los datos de telemetría muestran que a partir del 9 de febrero de 2026, la cantidad de capturas de esta característica de etiqueta Unicode ha mostrado un crecimiento explosivo. El número de detecciones en un solo día se disparó instantáneamente de miles a decenas de miles en el pasado a más de 1,3 millones, y alcanzó un máximo de más de 2,37 millones en un solo día a finales de febrero. Esta tendencia de ataques de alta frecuencia duró tres meses completos durante los días laborables, mostrando las características de una distribución automatizada y a gran escala muy regular.
La investigación muestra que esta vez el atacante no intentó inyectar instrucciones de ataque en la IA, sino que lo utilizó como método definitivo de ofuscación de "salación de texto". En la defensa tradicional contra el phishing, los filtros antispam se basan en gran medida en palabras confidenciales y firmas de reglas para interceptar correos electrónicos fraudulentos. En el pasado, los correos electrónicos no deseados solían utilizar espacios de ancho cero (U+200B) o espacios sin separación (U+00A0) para dividir palabras confidenciales, pero estos caracteres han sido básicamente defendidos universalmente por las puertas de enlace de seguridad modernas. En esta operación, la banda de fraude recurrió al uso de caracteres de etiquetas Unicode impopulares (como el espacio de etiquetas invisible U+E0020) y los insertó silenciosamente en palabras clave de fraude financiero como "préstamo", "financiamiento" y "crédito". Dado que la existencia de estos caracteres no puede detectarse a simple vista, los destinatarios comunes y corrientes ven una redacción fluida y natural; sin embargo, los motores de seguridad tradicionales basados en la coincidencia de cadenas serán completamente ineficaces porque las palabras se cortan a la fuerza en la capa inferior.

Lo que es aún más problemático es que este método de ofuscación también puede interferir con la nueva generación de sistemas inteligentes de detección de seguridad de correo electrónico basados en modelos de lenguaje grande (LLM). Cuando el modelo de seguridad de IA realiza la tokenización en los correos electrónicos, los caracteres Unicode especiales insertados interrumpirán directamente la comprensión semántica del tokenizador, lo que hará imposible que el modelo empalme y determine con precisión las características maliciosas contextuales, formando así un punto ciego de defensa.
En la ola de ataques revelada esta vez, los atacantes se centraron en cebos financieros como préstamos de financiación para pequeñas empresas, registraron una gran cantidad de nombres de dominio de correo electrónico descartables que contenían términos financieros específicos y abusaron inteligentemente de la infraestructura y la función de reescritura de salto de enlace de la plataforma legítima de marketing por correo electrónico ActiveCampaign para ocultar los nombres de dominio de salto maliciosos reales y evitar el bloqueo directo a nivel de IP.
Los expertos en seguridad señalaron que esta táctica de penetración encubierta originalmente dirigida a grandes modelos de inteligencia artificial de vanguardia ahora ha sido completamente absorbida por las industrias negras y transformada en un arma de grado industrial contra las defensas corporativas diarias. Esto también pone de relieve que, a medida que la inteligencia artificial está profundamente entrelazada con los estándares de carácter modernos, los límites entre las dimensiones del ciberataque y la defensa se están volviendo cada vez más borrosos. En respuesta a estas amenazas emergentes, las agencias de seguridad recomiendan que los administradores de sistemas de correo electrónico y los proveedores de seguridad agreguen pasos especiales de preprocesamiento antes de realizar coincidencias de texto y análisis semántico de modelos para limpiar y normalizar a fondo los bloques de etiquetas Unicode y los caracteres de control invisibles, de modo que las características maliciosas ocultas en el vacío sean invisibles.
Comentarios