Was herauskommt
Jeder Verräter ist ein bestimmter Unicode-Codepunkt, die Regeln sind also genau statt schlau.
Unsichtbar und ohne Breite: Leerzeichen ohne Breite (U+200B), Verbinder und Nichtverbinder (U+200D, U+200C), Wortverbinder (U+2060), bedingter Trennstrich (U+00AD), Bytereihenfolge-Marke (U+FEFF), Variantenwähler (U+FE00 bis U+FE0F), Schreibrichtungsmarken (U+200E, U+200F) und das schmale geschützte Leerzeichen (U+202F), um das es beim Wasserzeichen-Schreck von 2025 ging.
Satzzeichen: Geviertstrich zu Bindestrich, Komma, Leerzeichen oder nichts. Halbgeviertstrich zu Bindestrich. Typografische Anführungszeichen und Apostrophe zu geradem ASCII. Die Auslassungspunkte als ein Zeichen werden drei Punkte.
Abstände und Doppelgänger: geschützte Leerzeichen werden gewöhnliche, doppelte Leerzeichen fallen zusammen, und die NFKC-Normalisierung macht aus einem kyrillischen „а“ wieder den lateinischen Buchstaben, den es nachahmt. NFKC allein übergeht Striche, typografische Anführungszeichen und Emoji, jedes davon braucht also seine eigene Regel.
Originality.AI führt ein Verzeichnis von 87 solchen Zeichen mit Codepunkten und Ersetzungen.
Warum sie Dinge zerbrechen
Die unsichtbaren sind die teuren. Python wirft bei einem typografischen Anführungszeichen einen SyntaxError. JSON akzeptiert nur gerade ASCII-Anführungszeichen. Schreibrichtungs-Steuerzeichen treiben den Trojan-Source-Angriff (CVE-2021-42574) an, bei dem Code für einen Prüfer anders aussieht, als er übersetzt wird. Alle überleben das Kopieren zwischen Editoren und Betriebssystemen.
Der Geviertstrich hat eine langweiligere Erklärung als ein Wasserzeichen. Trainingsdaten stützen sich auf digitalisierte Druckbücher, und diese Prosa benutzt weit mehr Striche als wir. Eine Untersuchung maß bei GPT-4.1 ungefähr 10,6 Geviertstriche pro 1.000 Wörter ohne Aufforderung, und 3,9, wenn man darum bat, sie zu lassen.
Auf dem Mac läuft dieselbe Reinigung bei ⌘V in jedem Programm, offline, über Kliptos Anti-LLM-Umwandlung.
Häufige Fragen
Versieht ChatGPT Text mit unsichtbaren Zeichen als Wasserzeichen?
Nein. Im April 2025 berichtete Rumi, o3 und o4-mini schienen schmale geschützte Leerzeichen einzubetten. OpenAI nannte es „eine Eigenart groß angelegten bestärkenden Lernens“, und das Verhalten verschwand am nächsten Tag mit einem Update. Ein Wasserzeichen, das binnen 24 Stunden verschwindet und das Suchen-und-Ersetzen aushebelt, ist keines.
Hilft das Entfernen unsichtbarer Zeichen, an KI-Detektoren vorbeizukommen?
Nein. Detektoren bewerten Wortwahl und Satzrhythmus. Codepunkte zu säubern ändert an beidem nichts.
Funktioniert es auch mit Claude und Gemini?
Ja. Die Regeln greifen auf Zeichen, nicht auf Modelle, Text von jedem davon wird also gleich gereinigt. Genauso Text aus Word, aus einem PDF oder von einer Webseite.
Weiterlesen
- Gedankenstrich-Entferner · Typografische Anführungszeichen entfernen · Emojis entfernen
- Anti-LLM: KI-Text beim Einfügen säubern
- ChatGPT-Text säubern
Klipto laden und es stattdessen bei jedem Einfügen erledigen lassen.