Was dieser Unicode Text Konverter macht
Unicode ist der Standard, der jedem Zeichen eine Nummer gibt, vom Buchstaben A über chinesische Schriftzeichen bis zu Pfeilen und Emojis. Unter seinen vielen Tausend Zeichen sind vollständige Alphabete in fett, kursiv, Schreibschrift, Fraktur, Doppelstrich und Monospace. Es gibt sie vor allem für die Mathematik, wo der Stil eines Buchstabens seine Bedeutung ändern kann.
Weil diese Buchstaben eigene Zeichen sind, kannst du sie als „Schriftarten“ dort nutzen, wo nur reiner Text erlaubt ist. Dieser Unicode Text Konverter verwandelt deine Wörter in diese Zeichen und zeigt dir genau, was er erzeugt hat, bis hinunter zu jedem Codepunkt.
So nutzt du den Konverter
- Tippe in das Feld Dein Text oder füge Text ein, oder klicke auf Leeren, um leer zu beginnen.
- Die sechs Hauptergebnisse oben zeigen deinen Text in Fett, Kursiv, Schreibschrift, Fraktur, Doppelstrich und Monospace. Klicke neben jedem auf Kopieren.
- Wähl in der Codepunkt-Anzeige im Menü Codepunkte anzeigen für einen Stil. Mit „Dein Text wie getippt“ untersuchst du deine ursprüngliche Eingabe.
- Jedes Zeichen erscheint mit seinem U+-Code darunter. Kombinierende Zeichen werden auf einem gepunkteten Kreis gezeigt, Leerzeichen als ␣ und Zeilenumbrüche als ↵.
- Lies in der Zusammenfassung die Anzahl der Codepunkte, UTF-16-Einheiten und UTF-8-Bytes.
- Klicke auf Codepunkte kopieren, um die ganze Liste als Text zu kopieren, etwa „U+1D400 U+1D401“.
- Scroll zu Weitere Stile für jeden anderen Stil der Seite, jeweils mit einer Schaltfläche zum Kopieren.
So funktioniert es
Die meisten Hauptstile stammen aus dem Block Mathematical Alphanumeric Symbols, der von U+1D400 bis U+1D7FF reicht. Er ist in ordentlichen Reihen mit 26 Großbuchstaben und 26 Kleinbuchstaben pro Stil angelegt. Der Konverter findet einen gestalteten Buchstaben also, indem er vom ersten aus weiterzählt.
Ein paar Buchstaben waren schon Jahre vorher im Block Letterlike Symbols in Unicode gelandet, etwa ℝ für die reellen Zahlen, ℌ in Fraktur und ℎ in kursiv. Der Mathematik-Block lässt diese Plätze leer, und der Konverter füllt sie mit den älteren Zeichen. Die Codepunkt-Anzeige macht das leicht sichtbar: In einem Wort in Fraktur zeigt ein großes H den Wert U+210C, keine Zahl aus dem Bereich U+1D500.
Andere Stile nutzen andere Teile von Unicode. Blasenbuchstaben stammen aus Enclosed Alphanumerics, breite Buchstaben aus dem Block Halfwidth and Fullwidth Forms, Kapitälchen aus phonetischen Buchstaben, und Unterstreichen oder Durchstreichen aus kombinierenden Zeichen, die sich an den Buchstaben davor heften.
Viele dieser Zeichen sind „Kompatibilitätsformen“. Bei der von Unicode definierten Normalisierung NFKC wird ein fettes 𝐀 wieder einem normalen A zugeordnet. So können Suchmaschinen und Tools wie der Konverter Unicode in Text die Gestaltung rückgängig machen.
Beispiele
Der Buchstabe A in jedem Hauptstil, mit Codepunkten und Größen aus der Anzeige des Konverters:
| Stil | Zeichen | Codepunkt | UTF-16-Einheiten | UTF-8-Bytes |
|---|---|---|---|---|
| Normal | A | U+0041 | 1 | 1 |
| Fett | 𝐀 | U+1D400 | 2 | 4 |
| Schreibschrift | 𝒜 | U+1D49C | 2 | 4 |
| Fraktur | 𝔄 | U+1D504 | 2 | 4 |
| Doppelstrich | 𝔸 | U+1D538 | 2 | 4 |
| Monospace | 𝙰 | U+1D670 | 2 | 4 |
| Fraktur H | ℌ | U+210C | 1 | 3 |
Und ein ganzes Wort, „Unicode“, in jedem Hauptstil:
| Stil | Ergebnis |
|---|---|
| Fett | 𝐔𝐧𝐢𝐜𝐨𝐝𝐞 |
| Kursiv | 𝑈𝑛𝑖𝑐𝑜𝑑𝑒 |
| Schreibschrift | 𝒰𝓃𝒾𝒸ℴ𝒹ℯ |
| Fraktur | 𝔘𝔫𝔦𝔠𝔬𝔡𝔢 |
| Doppelstrich | 𝕌𝕟𝕚𝕔𝕠𝕕𝕖 |
| Monospace | 𝚄𝚗𝚒𝚌𝚘𝚍𝚎 |
In Fett besteht „Unicode“ aus 7 Codepunkten, 14 UTF-16-Einheiten und 28 UTF-8-Bytes. Normal getippt sind es jeweils 7.
Ein deutsches Wort in der Anzeige
Bei deutschen Wörtern zeigt die Codepunkt-Anzeige gleich zwei Besonderheiten. Normal getippt besteht „Größe“ aus den Codepunkten U+0047 U+0072 U+00F6 U+00DF U+0065: 5 Codepunkte, 5 UTF-16-Einheiten, aber 7 UTF-8-Bytes, weil ö und ß in UTF-8 je zwei Bytes brauchen. In Fett wird daraus „𝐆𝐫öß𝐞“ mit den Codepunkten U+1D406 U+1D42B U+00F6 U+00DF U+1D41E. Das ö und das ß bleiben unverändert, weil es für sie keine fetten Unicode-Versionen gibt. Das Ergebnis hat 5 Codepunkte, 8 UTF-16-Einheiten und 16 UTF-8-Bytes.
Manchmal zeigt die Anzeige ein ö auch als zwei Zeichen: ein o und ein kombinierendes Trema (U+0308) auf einem gepunkteten Kreis. Das passiert bei Text aus manchen Mac-Programmen oder PDFs, die Umlaute zerlegt speichern. Für Leser sieht es gleich aus, für Suchfunktionen und Längengrenzen ist es aber ein Unterschied.
Wem die Codepunkt-Anzeige hilft
- Entwicklern, die prüfen, warum ein Datenbankfeld, eine API oder ein Formular Text ablehnt, der „kurz aussieht“
- Social-Media-Verantwortlichen, die herausfinden wollen, warum eine Bio zu früh an ihre Grenze stößt
- Autoren und Designern, die nachsehen wollen, welche Zeichen ein Stil nutzt, bevor sie sich darauf verlassen
- Allen Neugierigen, die wissen wollen, warum ein Buchstabe in einem Wort etwas anders aussieht als der Rest
Tipps und Grenzen
Längengrenzen sind unterschiedlich. Manche Systeme zählen Codepunkte, manche UTF-16-Einheiten und manche Bytes. Gleich die Zusammenfassung mit der Regel ab, die die App wirklich verwendet.
Nicht jedes Zeichen hat einen Stil. Umlaute, ß, Buchstaben mit Akzent, die meisten Satzzeichen und Buchstaben aus anderen Alphabeten haben keine fette oder Schreibschrift-Form und bleiben deshalb unverändert.
Screenreader und Suche. Hilfstechnologien lesen gestaltete Buchstaben oft als mathematische Symbole vor oder überspringen sie, und die meisten Suchfelder ordnen sie keinen normalen Wörtern zu. Lass wichtige Informationen in normalem Text.
Der Font bestimmt den Look. Unicode legt fest, welches Zeichen es ist, und der Font auf dem Gerät der Lesenden zeichnet es. Ältere Geräte zeigen womöglich ein leeres Kästchen.
Versteckte Zeichen. Die Anzeige macht auch Zeichen sichtbar, die du nicht sehen kannst. Wenn du mit leeren Namen oder Tricks für Abstände arbeitest, erklärt der Generator für unsichtbaren Text jedes davon.
Ähnliche Tools
Der Generator für Schriftarten zum Kopieren setzt Verzierungen und Look-alike-Alphabete auf diese Stile drauf. Um einen Stil rückgängig zu machen, nimm den Konverter Unicode in Text.