Le « ASCII smuggling » inonde nos boîtes mail

D'après Ars Technica (4 septembre 2026 à 19h18)

Résumé

Une technique d’attaque initialement utilisée pour dissimuler des injections de prompts dans des agents IA est désormais exploitée à grande échelle par des spammeurs pour contourner les filtres de messagerie.

Les faits

Une technique de dissimulation de texte malveillant connue sous le nom de « ASCII smuggling » est passée des attaques sur les agents d’IA aux campagnes de spam par courriel. Ars Technica décrit « une technique astucieuse utilisée pour cacher des prompts malveillants » dans des attaques contre des agents d’IA, désormais « adoptée par des spammeurs pour contourner les filtres » des plateformes d’e‑mail. Le principe du ASCII smuggling repose sur un bloc spécifique de balises Unicode. L’article explique que « le bloc de 128 balises imite une partie du American Standard Code for Information Interchange presque parfaitement, avec une différence majeure : les caractères qu’il encode sont lisibles par les ordinateurs mais, par conception, presque totalement invisibles pour les humains ». Des exemples sont donnés : le point de balise U+E0041 reflète la lettre « A » et U+E0061 reflète « a », mais ces caractères ne sont pas visibles à l’écran pour l’utilisateur. Cette propriété est utilisée à l’origine pour rendre plus furtives des attaques de type injection de prompt sur les modèles de langage. Ars Technica précise que « les instructions malveillantes intégrées dans les e‑mails ou d’autres contenus non fiables à traiter par un LLM ne sont pas écrites en texte ordinaire » mais « rendues par une plage spéciale de balises Unicode ». Les modèles détectent les instructions, tandis que les personnes lisant le message ne les voient pas. Microsoft indique avoir observé plus tôt cette année une utilisation massive de cette technique dans des campagnes de spam. Selon les données issues de Microsoft Defender for Office, « à partir d’un jour au début février, le nombre de signatures de ASCII smuggling détectées […] a grimpé d’environ 21 000 par jour à plus de 1,3 million ». Ars Technica rapporte qu’« en quatre jours, les détections de signatures ont bondi à 2,5 millions », que ce « déluge a persisté pendant des mois » avant de « chuter nettement à la mi‑mai ». Microsoft résume la logique des attaquants en expliquant que « parce que les caractères de balise sont invisibles pour les humains mais existent au niveau du traitement de texte, la même propriété qui les rend utiles pour faire passer des instructions dans un modèle les rend aussi utiles pour obscurcir des mots‑clés avant qu’un détecteur ne les évalue ».

Pourquoi c’est important

Le basculement du ASCII smuggling des attaques ciblant les modèles de langage vers des campagnes de spam de masse illustre la rapidité avec laquelle les techniques issues de la sécurité de l’IA sont réutilisées dans la cybercriminalité traditionnelle. Le fait que des balises Unicode invisibles puissent coder une « copie fantôme » de caractères ASCII lisibles par les machines mais pas par les humains crée une zone grise où le contenu est interprété différemment par les filtres et par les destinataires. Les chiffres publiés par Microsoft sur la flambée des signatures détectées – de 21 000 à plus de 1,3 million par jour, puis jusqu’à 2,5 millions en quatre jours – montrent que l’adoption de ce procédé par les spammeurs est industrielle. La montée en charge brutale puis la chute à la mi‑mai indiquent une campagne coordonnée de grande ampleur. Cette évolution oblige les fournisseurs de messagerie à adapter leurs mécanismes de détection pour prendre en compte ces blocs de balises Unicode, sous peine de voir leurs filtres contournés par des messages dont le contenu visible paraît anodin mais dont la représentation texte exploite ces caractères invisibles.

Questions fréquentes

Qu’est‑ce que le « ASCII smuggling » ?

C’est l’usage d’un bloc de 128 balises Unicode qui imitent des caractères ASCII lisibles par les machines mais presque invisibles pour les humains, afin de cacher du texte.

Comment cette technique était-elle utilisée contre l’IA ?

Des instructions malveillantes pour des modèles de langage étaient rendues avec ces balises Unicode, détectables par le LLM mais invisibles pour les personnes lisant le message.

Pourquoi les spammeurs exploitent-ils le ASCII smuggling ?

Ils l’utilisent pour contourner les filtres d’e‑mail en obscurcissant des mots‑clés, tout en gardant des messages lisibles et rassurants pour les destinataires humains.

Quel volume d’activité Microsoft a‑t‑il observé en février ?

Les signatures de ASCII smuggling sont passées d’environ 21 000 par jour à plus de 1,3 million, puis à 2,5 millions en quatre jours, avant de se maintenir des mois.

Pourquoi ces balises Unicode sont‑elles difficiles à repérer ?

Les caractères sont conçus pour être lisibles par les ordinateurs mais presque totalement invisibles pour les humains, ce qui les rend indétectables à l’œil nu.

Source

Ars Technica

Auteur

Rédaction IA-Medias

Rédaction spécialisée dans la veille et l'analyse de l'actualité de l'intelligence artificielle, des puces IA, des robots, des agents IA et de la recherche.