Qué hace este convertidor de texto Unicode
Unicode es el estándar que le da un número a cada carácter, desde la letra A hasta los caracteres chinos, las flechas y los emojis. Entre sus muchos miles de caracteres hay alfabetos completos en negrita, cursiva, manuscrita, gótica, doble trazo y monoespaciada. Existen sobre todo para las matemáticas, donde el estilo de una letra puede cambiar su significado.
Como esas letras son caracteres independientes, puedes usarlas como “fuentes” en sitios que solo aceptan texto plano. Este convertidor de texto Unicode transforma tus palabras en esos caracteres y te muestra exactamente qué ha producido, hasta el último punto de código.
Cómo usar el convertidor
- Escribe o pega en el cuadro Tu texto, o pulsa Borrar para empezar en blanco.
- Los seis resultados principales de arriba muestran tu texto en Negrita, Cursiva, Manuscrita, Gótica, Doble trazo y Monoespaciada. Pulsa Copiar junto a cualquiera de ellos.
- En el panel de puntos de código, elige un estilo en el menú Mostrar puntos de código de. Elige “Tu texto tal como lo escribiste” para ver tu texto original.
- Cada carácter aparece con su código U+ debajo. Las marcas combinantes se muestran sobre un círculo punteado, los espacios como ␣ y los saltos de línea como ↵.
- Lee la línea de resumen para ver el número de puntos de código, unidades UTF-16 y bytes UTF-8.
- Pulsa Copiar puntos de código para copiar la lista entera como texto, por ejemplo “U+1D400 U+1D401”.
- Baja hasta Más estilos para ver todos los demás estilos del sitio, cada uno con su botón Copiar.
Cómo funciona
La mayoría de los estilos principales vienen del bloque Mathematical Alphanumeric Symbols (símbolos alfanuméricos matemáticos), que va de U+1D400 a U+1D7FF. Está ordenado en tramos de 26 mayúsculas y 26 minúsculas por estilo, así que el convertidor encuentra una letra con estilo contando desde la primera.
Algunas letras se habían añadido a Unicode años antes en el bloque Letterlike Symbols (símbolos con forma de letra), como ℝ para los números reales, ℌ en fraktur y ℎ en cursiva. El bloque matemático deja esos huecos vacíos, y el convertidor los rellena con los caracteres antiguos. El panel de puntos de código lo deja ver fácilmente: en una palabra gótica, una H mayúscula muestra U+210C, no un número del rango U+1D500.
Otros estilos usan otras partes de Unicode. Las letras burbuja vienen de Enclosed Alphanumerics, las letras anchas del bloque Halfwidth and Fullwidth Forms, las versalitas de letras fonéticas, y el subrayado o el tachado de marcas combinantes que se unen a la letra anterior.
Muchos de estos caracteres son formas de “compatibilidad”. Con la normalización NFKC que define Unicode, una 𝐀 en negrita se convierte en una A normal. Así es como los buscadores y herramientas como el convertidor de Unicode a texto pueden deshacer el estilo.
Ejemplos
La letra A en cada estilo principal, con los puntos de código y tamaños del propio panel del convertidor:
| Estilo | Carácter | Punto de código | Unidades UTF-16 | Bytes UTF-8 |
|---|---|---|---|---|
| Normal | A | U+0041 | 1 | 1 |
| Negrita | 𝐀 | U+1D400 | 2 | 4 |
| Manuscrita | 𝒜 | U+1D49C | 2 | 4 |
| Gótica | 𝔄 | U+1D504 | 2 | 4 |
| Doble trazo | 𝔸 | U+1D538 | 2 | 4 |
| Monoespaciada | 𝙰 | U+1D670 | 2 | 4 |
| H gótica | ℌ | U+210C | 1 | 3 |
Y una palabra entera, “Unicode”, en cada estilo principal:
| Estilo | Resultado |
|---|---|
| Negrita | 𝐔𝐧𝐢𝐜𝐨𝐝𝐞 |
| Cursiva | 𝑈𝑛𝑖𝑐𝑜𝑑𝑒 |
| Manuscrita | 𝒰𝓃𝒾𝒸ℴ𝒹ℯ |
| Gótica | 𝔘𝔫𝔦𝔠𝔬𝔡𝔢 |
| Doble trazo | 𝕌𝕟𝕚𝕔𝕠𝕕𝕖 |
| Monoespaciada | 𝚄𝚗𝚒𝚌𝚘𝚍𝚎 |
En Negrita, “Unicode” son 7 puntos de código, 14 unidades UTF-16 y 28 bytes UTF-8. Escrito de forma normal, son 7 de cada.
A quién le sirve el panel de puntos de código
- Desarrolladores que quieren saber por qué un campo de base de datos, una API o un formulario rechaza un texto que “parece” corto
- Gestores de redes sociales que quieren entender por qué una biografía llega antes de tiempo a su límite
- Redactores y diseñadores que quieren confirmar qué caracteres usa un estilo antes de confiar en él
- Cualquier curioso que se pregunte por qué una letra de una palabra se ve un poco distinta del resto
Consejos y límites
Los límites de longitud cambian. Algunos sistemas cuentan puntos de código, otros unidades UTF-16 y otros bytes. Compara la línea de resumen con la regla que use de verdad la app.
No todos los caracteres tienen estilo. Las letras con tilde, la ñ, la mayoría de los signos de puntuación y las letras de otros alfabetos no tienen forma en negrita ni manuscrita, así que pasan sin cambios. En español eso se nota: “Canción” en Negrita queda como 𝐂𝐚𝐧𝐜𝐢ó𝐧, con la ó normal. El panel también te ayuda aquí. Una ó escrita con el teclado suele ser un solo carácter (U+00F3), pero si el texto viene de otro sitio puede llegar como una o seguida de una tilde combinante (U+0301), y entonces verás dos puntos de código, el segundo sobre un círculo punteado.
Lectores de pantalla y búsqueda. Las tecnologías de apoyo suelen leer las letras con estilo como símbolos matemáticos o saltárselas, y la mayoría de los cuadros de búsqueda no las relacionan con las palabras normales. Deja en texto normal la información clave.
La fuente decide el aspecto. Unicode define qué carácter es, y la fuente del dispositivo de quien lo lee lo dibuja. Los dispositivos antiguos pueden mostrar un cuadro vacío.
Caracteres ocultos. El panel también revela caracteres que no se ven. Si trabajas con nombres en blanco o trucos de espaciado, el generador de texto invisible explica cada uno.
Herramientas relacionadas
El generador de letras bonitas añade decoraciones y alfabetos parecidos encima de estos estilos. Para deshacer cualquier estilo, usa el convertidor de Unicode a texto.