O tehnică asociată în ultimii ani cu securitatea sistemelor AI este folosită acum pentru a evita filtrele tradiționale de email. Microsoft Security Research a documentat o campanie de phishing în care atacatorii inserează caractere Unicode invizibile din blocul U+E0000–U+E007F în cuvinte precum „funding”, astfel încât mesajul să arate normal pentru utilizator, dar să fie procesat diferit de unele sisteme automate de detecție.
Microsoft numește tehnica „ASCII smuggling”. În cercetarea publicată pe 3 septembrie 2026, compania arată că semnătura de hunting creată inițial pentru identificarea prompt injection-urilor ascunse în email a început să detecteze un volum neobișnuit de mesaje financiare.
De la 21.000 la peste 1,3 milioane de mesaje într-o zi
Pe 8 februarie, semnătura Microsoft a detectat aproximativ 21.000 de mesaje. O zi mai târziu, volumul a trecut de 1,3 milioane. În zilele următoare, campania a ajuns la peste 2,3 milioane de mesaje zilnic, cu un vârf în 26 februarie. Activitatea a continuat intens aproximativ trei luni și a scăzut puternic după 15 mai.
Atacatorii foloseau domenii cu teme financiare, oferte de împrumuturi, linii de credit și finanțări pentru companii. Caracterele invizibile erau inserate în interiorul cuvintelor, rupând șirurile pe care unele reguli sau tokenizatoare le-ar putea căuta.
De ce tehnica este interesantă pentru atacatori
Pentru utilizator, textul continuă să fie afișat aproape normal. Pentru un sistem care caută o potrivire literală, însă, cuvântul nu mai este reprezentat de o secvență continuă de caractere. Problema poate afecta atât reguli clasice bazate pe semnături, cât și unele modele ML/NLP dacă normalizarea Unicode nu este făcută înainte de analiză.
Microsoft spune că peste 99% dintre mesajele observate au fost totuși detectate prin alte straturi de protecție — reputația expeditorului și a domeniilor, analiza URL-urilor, detecția de impersonare, autentificarea și clasificarea ML. Asta arată avantajul unei arhitecturi de securitate cu mai multe semnale, în locul dependenței de o singură regulă.
Ce trebuie să facă administratorii
Recomandarea principală este normalizarea textului înainte ca regulile, regex-urile și modelele de clasificare să îl proceseze. Caracterele invizibile și non-rendering ar trebui eliminate sau transformate într-o formă canonică. Prezența blocului Unicode Tags poate fi tratată și ca semnal de anomalie, deoarece este rar în traficul legitim.
Același control este relevant pentru sistemele AI care ingestionează emailuri. O normalizare consistentă reduce atât riscul de ocolire a filtrelor tradiționale, cât și suprafața de atac pentru prompt injection ascuns.