Ce que fait ce convertisseur de texte Unicode
Unicode est la norme qui donne un numéro à chaque caractère, de la lettre A aux caractères chinois en passant par les flèches et les emoji. Parmi ses dizaines de milliers de caractères figurent des alphabets complets en gras, italique, cursive, gothique, ajouré et chasse fixe. Ils existent surtout pour les mathématiques, où le style d’une lettre peut en changer le sens.
Comme ces lettres sont des caractères à part, vous pouvez les utiliser comme des « polices » là où seul le texte brut est accepté. Ce convertisseur de texte Unicode transforme vos mots en ces caractères et vous montre exactement ce qu’il a produit, jusqu’à chaque point de code.
Comment utiliser le convertisseur
- Tapez ou collez dans la zone Votre texte, ou appuyez sur Effacer pour partir de zéro.
- Les six résultats principaux en haut montrent votre texte en Gras, Italique, Cursive, Gothique, Ajouré et Chasse fixe. Appuyez sur Copier à côté de n’importe lequel.
- Dans le panneau des points de code, choisissez un style dans le menu Afficher les points de code de. Choisissez « Votre texte tel que tapé » pour examiner votre saisie d’origine.
- Chaque caractère apparaît avec son code U+ en dessous. Les signes combinants sont montrés sur un cercle pointillé, les espaces par ␣ et les sauts de ligne par ↵.
- Lisez la ligne de résumé pour le nombre de points de code, d’unités UTF-16 et d’octets UTF-8.
- Appuyez sur Copier les points de code pour copier toute la liste en texte, comme « U+1D400 U+1D401 ».
- Descendez jusqu’à Autres styles pour tous les autres styles du site, chacun avec un bouton Copier.
Comment ça marche
La plupart des styles principaux viennent du bloc des symboles alphanumériques mathématiques, qui va de U+1D400 à U+1D7FF. Il est organisé en séries régulières de 26 majuscules et 26 minuscules par style : le convertisseur trouve une lettre stylée en comptant depuis la première.
Quelques lettres avaient déjà été ajoutées à Unicode des années plus tôt dans le bloc des symboles de type lettre, comme ℝ pour les nombres réels, ℌ en Fraktur et ℎ en italique. Le bloc mathématique laisse ces emplacements vides, et le convertisseur les comble avec les anciens caractères. Le panneau des points de code le montre bien : dans un mot gothique, un H majuscule affiche U+210C, pas un numéro de la plage U+1D500.
D’autres styles utilisent d’autres parties d’Unicode. Les lettres bulles viennent des alphanumériques cerclés, les lettres larges du bloc des formes de demi-chasse et de pleine chasse, les petites capitales de lettres phonétiques, et le soulignement ou le barré de signes combinants qui s’accrochent à la lettre qui les précède.
Beaucoup de ces caractères sont des formes « de compatibilité ». Avec la normalisation NFKC définie par Unicode, un 𝐀 gras se ramène à un A simple. C’est ainsi que les moteurs de recherche et des outils comme le convertisseur Unicode en texte peuvent annuler le style.
Exemples
La lettre A dans chaque style principal, avec les points de code et les tailles tirés du panneau du convertisseur :
| Style | Caractère | Point de code | Unités UTF-16 | Octets UTF-8 |
|---|---|---|---|---|
| Normal | A | U+0041 | 1 | 1 |
| Gras | 𝐀 | U+1D400 | 2 | 4 |
| Cursive | 𝒜 | U+1D49C | 2 | 4 |
| Gothique | 𝔄 | U+1D504 | 2 | 4 |
| Ajouré | 𝔸 | U+1D538 | 2 | 4 |
| Chasse fixe | 𝙰 | U+1D670 | 2 | 4 |
| H gothique | ℌ | U+210C | 1 | 3 |
Et un mot entier, « Unicode », dans chaque style principal :
| Style | Résultat |
|---|---|
| Gras | 𝐔𝐧𝐢𝐜𝐨𝐝𝐞 |
| Italique | 𝑈𝑛𝑖𝑐𝑜𝑑𝑒 |
| Cursive | 𝒰𝓃𝒾𝒸ℴ𝒹ℯ |
| Gothique | 𝔘𝔫𝔦𝔠𝔬𝔡𝔢 |
| Ajouré | 𝕌𝕟𝕚𝕔𝕠𝕕𝕖 |
| Chasse fixe | 𝚄𝚗𝚒𝚌𝚘𝚍𝚎 |
En Gras, « Unicode » fait 7 points de code, 14 unités UTF-16 et 28 octets UTF-8. Tapé normalement, il en fait 7 de chaque.
À qui sert le panneau des points de code
- Aux développeurs qui cherchent pourquoi un champ de base de données, une API ou un formulaire refuse un texte qui « paraît » court
- Aux community managers qui veulent comprendre pourquoi une bio atteint sa limite trop tôt
- Aux rédacteurs et graphistes qui vérifient quels caractères un style utilise avant de s’y fier
- Aux curieux qui se demandent pourquoi une lettre d’un mot paraît un peu différente des autres
Conseils et limites
Les limites de longueur varient. Certains systèmes comptent les points de code, d’autres les unités UTF-16, d’autres encore les octets. Comparez la ligne de résumé avec la règle que l’application applique vraiment.
Tous les caractères n’ont pas de style. Les lettres accentuées, la plupart des signes de ponctuation et les lettres des autres alphabets n’ont pas de forme grasse ou cursive, ils passent donc sans changement. Dans un texte français, le panneau le montre bien : un é garde son point de code U+00E9 au milieu des lettres stylées.
Lecteurs d’écran et recherche. Les technologies d’assistance lisent souvent les lettres stylées comme des symboles mathématiques ou les ignorent, et la plupart des champs de recherche ne les associent pas aux mots normaux. Gardez les informations clés en texte normal.
Les polices décident du rendu. Unicode définit de quel caractère il s’agit, et la police de l’appareil du lecteur le dessine. Les appareils anciens peuvent afficher un carré vide.
Caractères cachés. Le panneau révèle aussi les caractères invisibles. Si vous travaillez avec des noms vides ou des astuces d’espacement, le générateur de texte invisible explique chacun d’eux.
Outils associés
Le générateur d’écriture stylée ajoute des décorations et des alphabets sosies à ces styles. Pour annuler n’importe quel style, utilisez le convertisseur Unicode en texte.