Was das Tool macht
Text aus Social-Media-Bios, Schrift-Generatoren, PDFs und Chat-Apps enthält oft mehr, als man sieht. Ein Name in schicker Schrift ist in Wahrheit eine Kette mathematischer Symbole. Ein Satz aus einem Textprogramm hat typografische Anführungszeichen und lange Striche. Eine Nachricht kann Leerzeichen mit Nullbreite verstecken, die ein Passwortfeld oder eine Tabellenformel kaputt machen. Dieses Tool findet diese Zeichen und tauscht sie gegen ihre normalen Tastaturversionen.
Nutze es, wenn:
- Text aus einem Schrift-Generator in einem Benutzernamenfeld oder Suchfeld nicht funktioniert
- ein eingefügter Name oder Code nicht passt, obwohl er identisch aussieht
- ein Formular Text mit „ungültigen Zeichen“ ablehnt
- du gerade Anführungszeichen für Code, CSV-Dateien oder die Kommandozeile brauchst
- dir jemand durchgestrichenen oder Glitch-Text geschickt hat und du ihn normal lesen willst
So nutzt du es
- Füge Text in Zu bereinigender Text ein. Ein Beispiel mit gemischten Problemen ist vorgeladen, damit du das Ergebnis zuerst sehen kannst.
- Das Feld Normaler Text aktualisiert sich beim Tippen.
- Wähl, was bereinigt werden soll. Fünf Optionen sind standardmäßig an:
- Schicke Schriften zu normalen Buchstaben
- Typografische Anführungszeichen, Striche und Auslassungspunkte zu Tastaturzeichen
- Unsichtbare Zeichen entfernen
- Glitch- und Durchstreichungszeichen entfernen
- Seltsame und doppelte Leerzeichen korrigieren
- Zwei Optionen sind standardmäßig aus: Akzente entfernen (é zu e) und Emojis entfernen.
- Klicke auf Kopieren oder Herunterladen. Der Hinweis unter dem Tool sagt, wie viele Zeichen bereinigt wurden.
Beispiele
Jedes Ergebnis wurde mit diesem Tool in den Standardeinstellungen erzeugt, außer die Tabelle sagt etwas anderes.
| Du fügst ein | Du bekommst |
|---|---|
| 𝗕𝗼𝗹𝗱 text | Bold text |
| 𝐼𝑡𝑎𝑙𝑖𝑐 | Italic |
| 𝓈𝒸𝓇𝒾𝓅𝓉 | script |
| 𝔹𝕒𝕝𝕝 | Ball |
| wide | wide |
| Ⓑⓤⓑⓑⓛⓔ | Bubble |
| ꜱᴍᴀʟʟ ᴄᴀᴘꜱ | small caps |
| S̶t̶r̶i̶k̶e̶ | Strike |
| “It’s fine,” she said… | “It’s fine,” she said… |
| „Schöne Grüße“, sagte sie ‚leise‘… | “Schöne Grüße”, sagte sie ‘leise’… |
| Wait, dann ein Geviertstrich, dann what? (ohne Leerzeichen geschrieben) | Wait-what? |
| München mit zerlegtem ü (u plus Trema-Zeichen) | München, der Hinweis meldet „1 Zeichen bereinigt.“ |
| Café crème, mit Akzente entfernen | Cafe creme |
| Schöne Grüße aus München, mit Akzente entfernen | Schone Grusse aus Munchen |
| Great job, gefolgt von zwei Emojis, mit Emojis entfernen | Great job |
Die deutschen Anführungszeichen „unten und oben“ und die einfachen ‚halben‘ werden also zu geraden Tastaturzeichen. Die französischen Anführungszeichen » und «, die in deutschen Büchern und in der Schweiz verbreitet sind, bleiben dagegen unverändert: Für „»Zitat« und ›auch‹“ meldet das Tool „Schon normaler Text. Nichts zu ändern.“
So funktioniert es
Unicode, der Standard hinter allem Text auf Computern, enthält viele Zeichen, die gestaltete Kopien normaler Buchstaben sind. Die meisten haben einen offiziellen Vermerk, für welchen normalen Buchstaben sie stehen. Der Konverter nutzt diese Information, um jeden gestalteten Buchstaben wieder A bis Z oder 0 bis 9 zuzuordnen. Ein paar Stile, etwa Kapitälchen und die schwarzen Kästchenbuchstaben, haben keine offizielle Verbindung, dafür nutzt das Tool eine eigene Tabelle.
Die anderen Optionen funktionieren genauso, eine Zeichengruppe nach der anderen:
- Typografische Anführungszeichen, Striche und Auslassungspunkte werden zu ’ und “ und - und drei Punkten. Dazu gehören der Geviertstrich (U+2014), der Halbgeviertstrich (U+2013) und das Minuszeichen. Aufzählungspunkte werden zu Bindestrichen.
- Unsichtbare Zeichen werden entfernt. Dazu gehören das Leerzeichen mit Nullbreite, der Verbinder mit Nullbreite, der weiche Trennstrich, die Byte Order Mark, Richtungszeichen und leere Füllzeichen wie Hangul Filler und Braille Blank.
- Glitch- und Durchstreichungszeichen sind kombinierende Zeichen, die auf Buchstaben gestapelt sind. Entfernt man sie, bleiben die Buchstaben darunter übrig. Ein einzelner Akzent, der zu einem Buchstaben gehört, etwa in é oder ein zerlegt gespeichertes ü, bleibt erhalten. Ein zerlegtes ü (ein u mit nachgestelltem Trema-Zeichen, wie es macOS etwa in Dateinamen speichert) wird dabei zu einem einzigen Zeichen zusammengefügt, und der Hinweis zählt jeden so verbundenen Buchstaben als bereinigtes Zeichen mit.
- Seltsame Leerzeichen wie das geschützte Leerzeichen und das Geviert-Leerzeichen werden zu normalen Leerzeichen, und mehrere Leerzeichen innerhalb einer Zeile schrumpfen auf eins.
Hindi, Arabisch, Chinesisch und andere Schriften bleiben in Ruhe. Nur die genannten Zeichen werden geändert.
Tipps und Grenzen
- Hochgestellte Ziffern bleiben. Aus x² ein x2 zu machen, würde die Bedeutung ändern. Hochgestellte Zahlen werden deshalb nicht angefasst, auch nicht m² und m³.
- Text auf dem Kopf und gespiegelter Text nutzen ähnlich aussehende Buchstaben aus anderen Alphabeten. Die werden nicht zurückverwandelt. Für gespiegelten Text nimm die umgekehrte Richtung des Spiegelschrift Generators.
- Umlaute sind eine Entscheidung. Lass Akzente entfernen bei Namen und normalem Text aus. Schalte es für Dateinamen, URLs und Systeme ein, die nur ASCII annehmen. Beachte, dass aus ü dabei u wird und nicht ue.
- Das Entfernen von Emojis entfernt auch Symbole wie das Copyright-Zeichen, weil Unicode sie in dieselbe Gruppe einordnet.
- Wenn es dir nur um lange Striche geht, gibt dir Gedankenstriche entfernen mehr Kontrolle darüber, was sie ersetzt.
Andere Wege
In Microsoft Word und Google Docs entfernt Einfügen als reiner Text (in den meisten Browsern und in Docs Strg+Umschalt+V) Fettschrift, Farben und Links, behält aber schicke Unicode-Buchstaben, typografische Anführungszeichen und unsichtbare Zeichen, weil das Zeichen sind und keine Formatierung. In Excel entfernt =SÄUBERN(A1) (englisch =CLEAN(A1)) einige Steuerzeichen und =GLÄTTEN(A1) (englisch =TRIM(A1)) überflüssige Leerzeichen, aber keine der beiden Funktionen fasst gestaltete Buchstaben an. Im Code wandelt die Unicode-Normalisierung (text.normalize('NFKC') in JavaScript oder unicodedata.normalize('NFKC', text) in Python) die meisten gestalteten Buchstaben um, ändert aber auch Dinge, die du vielleicht behalten willst, etwa ½ und hochgestellte Zahlen.
Um stattdessen HTML-Tags oder Markdown-Zeichen zu entfernen, nimm Formatierung entfernen. Um nur Leerzeichen und Leerzeilen aufzuräumen, nimm Leerzeichen entfernen.