Massen-Textformat-Bereiniger Entfernen Sie gemischte Halb-/Vollbreitenzeichen, unsichtbare Unicode-Zeichen und KI-Kopierspuren mit einem Klick
Schritt 1: Text zum Bereinigen einfügen
Schritt 2: Erkennungsergebnisse
Diese Zahlen stammen aus einer exakten, zeichenweisen Analyse — keiner semantischen Schätzung. Genau das ist die Schwäche von KI-Chatbots: Sie verstehen Bedeutung sehr gut, gelten aber als unzuverlässig beim präzisen Zählen einzelner Zeichen.
Schritt 3: Zu übernehmende Bereinigungen wählen
Erkennt vollbreite Buchstaben/Zahlen/Symbole, die in halbbreiten Text gemischt sind (oder umgekehrt), und lässt Sie die Normalisierungsrichtung wählen.
Entfernt Zero-Width-Spaces, Joiner, BOM und andere für das Auge unsichtbare Zeichen, die Suche und Layout stören.
Korrigiert Formatierungsspuren, die beim Kopieren aus KI-Chats häufig zurückbleiben.
Reduziert wiederholte Leerzeichen und Leerzeilen und entfernt überflüssige Leerzeichen am Anfang/Ende jeder Zeile.
Warum sieht eingefügter Text manchmal „kaputt" aus?
Wenn Sie Text aus ChatGPT, Word, PDFs oder übersetzten Dokumenten kopieren, enthält er oft Zeichen, die für das Auge unsichtbar sind, aber vom Computer trotzdem verarbeitet werden — Zero-Width-Spaces, übrig gebliebene Byte-Order-Mark-Bytes (BOM) oder bidirektionale Steuerzeichen. Diese unsichtbaren Zeichen können die Suche stören, die Zeichenzählung verfälschen oder sogar zu falschen „Duplicate Content"-Warnungen führen, sobald der Text in ein CMS, eine Tabelle oder Code eingefügt wird. Außerdem lassen KI-Chat-Tools oft stilistische Spuren zurück: typografische Anführungszeichen (“” ‘’), vereinheitlichte Gedankenstriche (—) und Markdown-Symbole (**fett**, # Überschrift), die für die Chat-Darstellung gedacht waren, nicht für Ihr Dokument.
Dieses Tool läuft zu 100 % lokal in Ihrem Browser. Nichts, was Sie einfügen, wird jemals hochgeladen.
Was dieses Tool erkennt und bereinigt
- Halb-/Vollbreiten-Normalisierung: erkennt vollbreite Buchstaben, Zahlen und Satzzeichen, die in halbbreiten Text gemischt sind (oder umgekehrt), und lässt Sie alles auf eine einheitliche Breite umwandeln.
- Unsichtbare Unicode-Zeichen: findet und entfernt Zero-Width-Space (U+200B), Joiner/Non-Joiner (U+200C/U+200D), BOM (U+FEFF), Word Joiner, weiches Trennzeichen und bidirektionale Steuerzeichen — mit der genauen Anzahl für jeden Typ.
- KI-Kopierspuren: wandelt typografische Anführungszeichen in gerade um, vereinheitlicht Gedankenstriche und entfernt übrig gebliebene Markdown-Symbole.
- Whitespace-Bereinigung: komprimiert wiederholte Leerzeichen und Leerzeilen und entfernt überflüssige Leerzeichen am Anfang/Ende jeder Zeile.
Warum nicht einfach eine KI bitten, es zu bereinigen?
Große Sprachmodelle lesen Text semantisch — sie sind notorisch unzuverlässig beim präzisen, zeichenweisen Zählen und bei der Unicode-Erkennung auf Byte-Ebene, eine gut dokumentierte Schwäche von LLMs. Dieses Tool scannt statt dessen jedes Zeichen deterministisch, sodass die angezeigten Zahlen exakt sind und keine Schätzung einer KI.
Häufige Fragen
F1: Lädt dieses Tool meinen Text irgendwohin hoch?
Nein. Erkennung und Bereinigung erfolgen vollständig lokal in Ihrem Browser — nichts wird je an einen Server gesendet, was das Tool sicher für Texte mit persönlichen oder vertraulichen Informationen macht.
F2: Beschädigt die Halb-/Vollbreiten-Normalisierung meinen chinesischen/japanischen/koreanischen Text?
Nein. Die Normalisierung betrifft nur lateinische Buchstaben, Zahlen und Satzzeichen im ASCII-Bereich (U+FF01-U+FF5E). Zeichen, die natürlich vollbreit sind, wie Chinesisch, Japanisch oder Koreanisch, bleiben unverändert.
Das könnten Sie auch brauchen