Spammer nutzen eine ehemals für KI-Angriffe entwickelte Technik, den sogenannten ASCII-Schmuggel, um E-Mail-Filter zu umgehen. Microsoft verzeichnete Anfang Februar einen massiven Anstieg dieser Methode: Die täglichen Erkennungen von ASCII-Schmuggel-Signaturen durch Microsoft Defender for Office stiegen von rund 21.000 auf über 1,3 Millionen und erreichten innerhalb von vier Tagen 2,5 Millionen. Dieses hohe Aufkommen hielt mehrere Monate an, bevor es Mitte Mai stark zurückging.
Was ASCII-Schmuggel ist
ASCII-Schmuggel ist eine Methode, bei der bösartige Anweisungen oder Texte in einem speziellen Bereich von Unicode-Tags verborgen werden. Diese Tags bilden 128 Zeichen des American Standard Code for Information Interchange (ASCII) nach, sind jedoch für Menschen nahezu unsichtbar. Computer und speziell trainierte Künstliche Intelligenzen, wie große Sprachmodelle (LLMs – Large Language Models), können diese Zeichen jedoch erkennen und verarbeiten. Ursprünglich wurde die Technik vor zwei Jahren bekannt, um sogenannte Prompt Injections – das Einschleusen manipulierter Anweisungen in KI-Systeme – zu verschleiern.
Wie Spammer die Technik nutzen
Microsoft zufolge nutzen Spammer die Eigenschaft der Unsichtbarkeit nun, um E-Mail-Filter zu umgehen, die nach bestimmten Schlüsselwörtern wie Geldbeträgen oder den Wörtern Kredit und Bedingung suchen. Indem sie unsichtbare Unicode-Zeichen mitten in ein Wort wie Finanzierung einfügen, kann der Filter das Wort möglicherweise als Finan und zierung oder als einzelne, unbekannte Teile lesen. Der Empfänger sieht das Wort Finanzierung jedoch korrekt. Diese Vorgehensweise ist nicht gänzlich neu; Spammer nutzten bereits seit Jahrzehnten ähnliche Methoden wie unsichtbare Leerzeichen, um Filter zu täuschen.
Ein wesentlicher Grund für die aktuelle Verbreitung des ASCII-Schmuggels liegt darin, dass viele Spamfilter noch nicht darauf programmiert waren, diese speziellen Unicode-Tags zu erkennen. Zudem zielt die Methode darauf ab, die Effektivität von modernen Spam- und Phishing-Klassifizierungssystemen zu untergraben, die auf maschinellem Lernen (ML) und der Verarbeitung natürlicher Sprache (NLP) basieren. Solche Systeme zerlegen Text oft in Token oder Teilwörter. Ein eingefügtes unsichtbares Zeichen kann dazu führen, dass ein bekanntes Wort in unerwartete oder unbekannte Token aufgeteilt wird, was die Erkennung erschwert.
Hinweise für Entwickler
Microsoft hat in einem Beitrag vom Donnerstag Entwicklern Anleitungen gegeben, wie sie Filter so programmieren können, dass sie dem ASCII-Schmuggel in Spam-Nachrichten besser begegnen können.
Thema: Technologie / KI allgemein. Quelle/Inspiration: Ars Technica.