Résumé :
Une technologie furtive qui était à l'origine célèbre pour le jailbreak de l'intelligence artificielle et les attaques par injection de mots rapides - "ASCII Smuggling" - a maintenant été utilisée à grande échelle dans des activités de spam et de phishing. L'équipe de recherche en sécurité de Microsoft a révélé que les cyberattaquants utilisent cette méthode pour contourner les passerelles de messagerie et les systèmes anti-spam traditionnels et envoyer des messages frauduleux à des millions de boîtes aux lettres.

Le principe de base de la « contrebande ASCII » consiste à utiliser des caractères Unicode spéciaux qui sont invisibles ou non rendus par l'œil humain dans les normes modernes de codage de texte pour intégrer des informations cachées dans un texte apparemment normal. La méthode la plus couramment utilisée est le "bloc de balises" Unicode (la plage de codage va de U+E0000 à U+E007F). Ce bloc a été initialement conçu pour le balisage du langage et est désormais largement abandonné. Il contient des « images fantômes » de caractères ASCII imprimables standard (par exemple, U+E0041 correspond à la lettre majuscule A). Lorsqu'ils sont vus par l'œil humain ou par la plupart des interfaces conventionnelles, ces caractères sont complètement invisibles et n'affichent aucun contenu visuel ; cependant, le logiciel d'analyse sous-jacent et le grand modèle de langage d'intelligence artificielle peuvent toujours reconnaître et traiter ces textes cachés lors de la lecture du flux de caractères d'origine. Auparavant, les pirates utilisaient souvent ce mécanisme pour « introduire » secrètement des instructions malveillantes dans le processus de traitement de l'IA, incitant l'assistant IA à divulguer des données privées ou à effectuer des opérations non autorisées à l'insu de l'utilisateur.

Cependant, lorsque l'équipe de recherche de Microsoft développait une bibliothèque de signatures de protection contre l'injection de mots rapides pour son système Defender pour Office 365, elle a accidentellement détecté l'application déguisée de cette arme d'attaque IA dans la fraude en ligne traditionnelle. Les données de télémétrie montrent qu'à partir du 9 février 2026, le nombre de captures de cette fonctionnalité de balise Unicode a connu une croissance explosive. Le nombre de détections en une seule journée est passé instantanément de milliers à plusieurs dizaines de milliers dans le passé à plus de 1,3 million, et a atteint un pic de plus de 2,37 millions en une seule journée fin février. Cette tendance d'attaques à haute fréquence a duré trois mois complets pendant les jours ouvrables, montrant les caractéristiques d'une distribution automatisée et à grande échelle très régulière.
L'enquête montre que l'attaquant n'a pas tenté d'injecter des instructions d'attaque dans l'IA cette fois-ci, mais l'a utilisé comme méthode ultime d'obfuscation de « salage de texte ». Dans la défense contre le phishing traditionnelle, les filtres anti-spam s'appuient largement sur des mots sensibles et des signatures de règles pour intercepter les e-mails frauduleux. Dans le passé, les courriers indésirables utilisaient souvent des espaces de largeur nulle (U+200B) ou des espaces insécables (U+00A0) pour diviser les mots sensibles, mais ces caractères ont été fondamentalement universellement défendus par les passerelles de sécurité modernes. Dans cette opération, le gang de fraude s'est tourné vers l'utilisation de caractères de balise Unicode impopulaires (tels que l'espace de balise invisible U+E0020) et les a discrètement insérés dans des mots-clés de fraude financière tels que « prêt », « financement » et « crédit ». Puisque l’existence de ces caractères ne peut être détectée à l’œil nu, les destinataires ordinaires voient une rédaction fluide et naturelle ; cependant, les moteurs de sécurité traditionnels basés sur la correspondance de chaînes seront totalement inefficaces car les mots sont coupés de force au niveau de la couche inférieure.

Ce qui est encore plus gênant, c'est que cette méthode d'obscurcissement peut également interférer avec la nouvelle génération de systèmes intelligents de détection de la sécurité des e-mails basés sur des modèles de langage étendus (LLM). Lorsque le modèle de sécurité de l'IA effectue la tokenisation des e-mails, les caractères Unicode spéciaux insérés perturberont directement la compréhension sémantique du tokenizer, rendant impossible pour le modèle d'épisser et de déterminer avec précision les caractéristiques malveillantes contextuelles, formant ainsi un angle mort de défense.
Dans la vague d'attaques révélée cette fois-ci, les attaquants se sont concentrés sur des appâts financiers tels que les prêts de financement aux petites entreprises, ont enregistré un grand nombre de noms de domaine de messagerie jetables contenant des conditions financières spécifiques et ont intelligemment abusé de l'infrastructure et de la fonction de réécriture de saut de lien de la plateforme légitime de marketing par courrier électronique ActiveCampaign pour masquer les véritables noms de domaine de saut malveillants et éviter le blocage direct au niveau IP.
Les experts en sécurité ont souligné que cette tactique de pénétration secrète, initialement ciblée sur les grands modèles d'IA de pointe, a désormais été entièrement absorbée par les industries noires et transformée en une arme de qualité industrielle contre les défenses quotidiennes des entreprises. Cela montre également que, à mesure que l’intelligence artificielle est profondément liée aux normes de caractère modernes, les frontières entre les dimensions de cyberattaque et de défense deviennent de plus en plus floues. En réponse à ces menaces émergentes, les agences de sécurité recommandent aux administrateurs de systèmes de messagerie et aux fournisseurs de sécurité d'ajouter des étapes de prétraitement spéciales avant d'effectuer une correspondance de texte et une analyse sémantique de modèle afin de nettoyer et de normaliser en profondeur les blocs de balises Unicode et les caractères de contrôle invisibles, afin que les fonctionnalités malveillantes cachées dans le vide soient invisibles.
Commentaires