Künstliche Intelligenz (KI) erweist sich zunehmend als wertvolles Werkzeug in der Linguistik, insbesondere bei der Entzifferung verlorener Sprachen. Sie agiert als schneller Assistent für menschliche Hypothesen, ersetzt jedoch nicht die grundlegende Notwendigkeit eines sprachlichen Ankers oder die Expertise von Forschenden. Ein aktueller Fall zeigt das Potenzial und die Grenzen dieser Technologie.
Im Juni 2026 beanspruchte ein autodidaktischer KI-Ingenieur und Amateur-Linguist einen Durchbruch bei der Entzifferung von Linear A. Dieses Schriftsystem der minoischen Zivilisation der Bronzezeit auf Kreta gilt als Sprachisolat, da es keine bestätigte Verbindung zu bekannten Sprachen aufweist und somit seit über einem Jahrhundert eine Herausforderung für Linguisten darstellt. Der Ingenieur begann mit der Annahme, dass ein unbekanntes Wort in einer Gebetsinschrift von einer semitischen Wurzel abgeleitet war, die „wohnen“ oder „bewohnen“ bedeutet. Mithilfe von KI-basierten Programmier-Skripten testete er dieses Lautmuster gegen das gesamte gesammelte Linear-A-Korpus. Er konnte angeblich 40 Zeichen Werte zuweisen und ein Lexikon von 408 Wörtern erstellen, was seiner Ansicht nach belegt, dass Linear A ein ausgestorbenes Mitglied der semitischen Sprachgruppe (zu der Hebräisch und Aramäisch gehören) ist.
KI als mächtiger Assistent bei der Mustererkennung
Die Rolle der KI in diesem und ähnlichen Szenarien ist die eines Forschungsassistenten. Sie kann menschliche Hypothesen rasch gegen Tausende von Zeichen abgleichen – eine Aufgabe, die manuell Monate dauern würde. KI ist besonders stark im großflächigen Testen von Mustern. Sie kann in Minuten überprüfen, ob eine Vermutung über ein Zeichen oder Wort in einem gesamten Archiv Bestand hat, wiederholte Sequenzen erkennen, die das menschliche Auge übersehen würde, und beschädigte oder fragmentarische Inschriften durch die Vorhersage wahrscheinlicher fehlender Zeichen ergänzen.
Ein weiterer Bereich, in dem KI hilft, ist der sogenannte „quersprachliche Transfer“ (cross-lingual transfer). Dabei kann ein Modell, das auf einer bekannten Sprache trainiert wurde, manchmal Muster in einer eng verwandten, unbekannten Sprache ableiten. Dieser Ansatz wurde bereits erfolgreich bei Schriften wie Ugaritisch angewendet, einer ausgestorbenen semitischen Sprache der späten Bronzezeit (etwa 1300-1190 v. Chr.), deren Sprachfamilie bekannt ist.
Grenzen der KI: Bedeutung und Verifizierung
Trotz dieser Fähigkeiten stößt die KI an klare Grenzen. Die statistische Mustererkennung kann keine Bedeutung aus dem Nichts erzeugen. Sie benötigt einen „Anker“ – eine bekannte Sprachfamilie oder einen zweisprachigen Text (wie den Stein von Rosette) –, um zu unterscheiden, welche Muster bedeutungsvoll und welche Zufall sind. Sprachen wie Linear A und Etruskisch (eine Sprache Italiens vor dem Römischen Reich, deren Grammatik und tiefere Bedeutung Linguisten noch immer entgeht) sind gerade deshalb so schwer zu entschlüsseln, weil dieser Anker fehlt oder unvollständig ist.
Obwohl ein KI-Modell mit einem ausreichend großen Korpus hypothetisch fließend genug werden könnte, um statistisch mit einem minoischen oder etruskischen Sprecher zu „kommunizieren“ – also wiederkehrende Wortmuster zu erkennen und diese in neuen Kontexten zu verwenden –, könnte es einem Menschen keine echte Übersetzung liefern. Sprachliche Geläufigkeit im statistischen Sinne und tatsächliche Bedeutung sind hier nicht dasselbe. Das Modell kann lernen, welche Zeichen aufeinanderfolgen oder welche Wörter zusammengehören, ohne jemals zu wissen, worauf sie sich tatsächlich beziehen.
Die Verifizierung von KI-unterstützten Behauptungen über diese Sprachen ist ebenfalls schwierig. Normalerweise würde man eine vorgeschlagene Übersetzung anhand von Muttersprachlern, anderen Texten oder einem über Jahrzehnte aufgebauten Expertenkonsens überprüfen. Für wirklich unentzifferte Sprachen existiert all dies nicht. Das gesamte erhaltene Korpus von Linear A umfasst beispielsweise nur etwa 7.500 Zeichen, was auf einen einzigen Bildschirm passt. Bei so wenig Daten kann fast jede Hypothese einzelne Übereinstimmungen finden, die sie stützen.
Deshalb sind Behauptungen in diesem Bereich stark auf unabhängige Expertenprüfung und Peer-Review angewiesen, anstatt auf statistische Konfidenzwerte. Es ist entscheidend zu unterscheiden zwischen „KI hat ein Muster gefunden“ und „KI hat die korrekte Bedeutung gefunden“. KI ist ein Beschleuniger, kann aber die beiden entscheidenden Zutaten für die Entzifferung nicht ersetzen: einen echten vergleichenden Anker und eine rigorose menschliche Überprüfung, um einen tatsächlichen Durchbruch von einem zufälligen Muster zu unterscheiden.
Thema: Technologie / KI allgemein. Quelle/Inspiration: Ars Technica.