유니코드 폰트 변환기로 할 수 있는 일
유니코드는 알파벳 A부터 한글, 한자, 화살표, 이모지까지 모든 문자에 번호를 붙이는 표준입니다. 수많은 문자 가운데에는 볼드, 이탤릭, 필기체, 고딕(블랙레터), 더블 스트럭, 모노스페이스으로 된 완전한 알파벳 세트도 들어 있습니다. 이 문자들은 원래 글자 모양에 따라 의미가 달라지는 수학 기호용으로 만들어졌습니다.
이 글자들은 별개의 문자이기 때문에 일반 텍스트만 받는 곳에서도 ‘폰트’처럼 쓸 수 있습니다. 이 유니코드 폰트 변환기는 입력한 단어를 그런 문자로 바꾸고, 결과가 정확히 어떤 문자로 이루어졌는지 코드 포인트 하나하나까지 보여 줍니다.
스타일 문자는 영문 알파벳과 숫자에만 있습니다. 한글을 입력하면 한글은 그대로 남고 영문과 숫자만 바뀝니다. 예를 들어 볼드에 안녕 Hi 123을 넣으면 안녕 𝐇𝐢 𝟏𝟐𝟑이 나옵니다.
사용 방법
- 텍스트 입력 상자에 글을 입력하거나 붙여넣습니다. 처음부터 다시 쓰려면 지우기를 누릅니다.
- 위쪽 큰 결과 여섯 개는 텍스트를 볼드(Bold), 이탤릭(Italic), 필기체(Script), 고딕(Gothic, 블랙레터), 더블 스트럭(Double Struck), 모노스페이스(Monospace)으로 보여 줍니다. 원하는 결과 옆의 복사를 누릅니다.
- 코드 포인트 패널의 코드 포인트 표시 대상 메뉴에서 스타일을 고릅니다. 원래 입력한 글을 살펴보려면 ‘입력한 그대로’를 고릅니다.
- 글자마다 아래에 U+ 코드가 표시됩니다. 결합 문자는 점선 원 위에, 공백은 ␣, 줄바꿈은 ↵로 나타납니다.
- 요약 줄에서 코드 포인트 수, UTF-16 단위 수, UTF-8 바이트 수를 확인합니다.
- 코드 포인트 복사를 누르면 “U+1D400 U+1D401”처럼 목록 전체가 텍스트로 복사됩니다.
- 아래 더 많은 스타일로 내려가면 이 사이트의 다른 모든 스타일이 각각 복사 버튼과 함께 나옵니다.
작동 원리
주요 스타일 대부분은 U+1D400부터 U+1D7FF까지인 수학 영숫자 기호(Mathematical Alphanumeric Symbols) 블록에서 가져옵니다. 이 블록은 스타일마다 대문자 26개와 소문자 26개가 가지런히 이어져 있어서, 변환기는 첫 글자부터 순서를 세어 해당 스타일 글자를 찾습니다.
몇몇 글자는 그보다 몇 년 앞서 문자형 기호(Letterlike Symbols) 블록에 먼저 추가되었습니다. 실수 집합을 뜻하는 ℝ, 프락투어 ℌ, 이탤릭 ℎ 같은 글자입니다. 수학 블록은 이 자리를 비워 두었고, 변환기는 빈자리를 예전 문자로 채웁니다. 코드 포인트 패널을 보면 쉽게 알 수 있습니다. 고딕 단어에서 대문자 H는 U+1D500대 번호가 아니라 U+210C로 표시됩니다.
다른 스타일은 유니코드의 다른 영역을 씁니다. 동그라미 글자는 원문자(Enclosed Alphanumerics) 블록에서, 넓은 글자는 반각 및 전각 형태(Halfwidth and Fullwidth Forms) 블록에서, 스몰캡은 음성 기호에서 가져옵니다. 밑줄과 취소선은 바로 앞 글자에 붙는 결합 문자로 만듭니다.
이 문자 상당수는 ‘호환’ 문자입니다. 유니코드가 정한 NFKC 정규화를 거치면 굵은 𝐀는 일반 A로 돌아갑니다. 검색 엔진이나 특수 폰트 일반 텍스트 변환기 같은 도구가 스타일을 되돌릴 수 있는 것도 이 덕분입니다.
예시
각 주요 스타일의 A를 변환기 패널에 나온 코드 포인트, 크기와 함께 정리했습니다.
| 스타일 | 문자 | 코드 포인트 | UTF-16 단위 | UTF-8 바이트 |
|---|---|---|---|---|
| 일반 | A | U+0041 | 1 | 1 |
| 볼드 | 𝐀 | U+1D400 | 2 | 4 |
| 필기체 | 𝒜 | U+1D49C | 2 | 4 |
| 고딕 | 𝔄 | U+1D504 | 2 | 4 |
| 더블 스트럭 | 𝔸 | U+1D538 | 2 | 4 |
| 모노스페이스 | 𝙰 | U+1D670 | 2 | 4 |
| 고딕 H | ℌ | U+210C | 1 | 3 |
단어 “Unicode”를 각 주요 스타일로 바꾼 결과입니다.
| 스타일 | 결과 |
|---|---|
| 볼드 | 𝐔𝐧𝐢𝐜𝐨𝐝𝐞 |
| 이탤릭 | 𝑈𝑛𝑖𝑐𝑜𝑑𝑒 |
| 필기체 | 𝒰𝓃𝒾𝒸ℴ𝒹ℯ |
| 고딕 | 𝔘𝔫𝔦𝔠𝔬𝔡𝔢 |
| 더블 스트럭 | 𝕌𝕟𝕚𝕔𝕠𝕕𝕖 |
| 모노스페이스 | 𝚄𝚗𝚒𝚌𝚘𝚍𝚎 |
볼드로 바꾼 “Unicode”는 코드 포인트 7개, UTF-16 14단위, UTF-8 28바이트입니다. 그냥 입력하면 셋 모두 7입니다.
한글도 패널에서 확인할 수 있습니다. ‘한’은 U+D55C이고 UTF-16 1단위, UTF-8 3바이트입니다. 한글 Hi를 입력하면 요약 줄에 코드 포인트 5개, UTF-16 5단위, UTF-8 9바이트가 표시됩니다.
코드 포인트 패널이 도움이 되는 사람
- 개발자: 짧아 ‘보이는’ 텍스트를 데이터베이스 필드, API, 입력 폼이 왜 거부하는지 확인할 때
- SNS 담당자: 프로필 소개가 왜 생각보다 일찍 글자 수 제한에 걸리는지 알아볼 때
- 작가와 디자이너: 스타일을 쓰기 전에 어떤 문자로 이루어졌는지 확인할 때
- 궁금한 모든 사람: 단어 속 한 글자만 왜 조금 달라 보이는지 알고 싶을 때
팁과 한계
글자 수 제한 기준은 제각각입니다. 코드 포인트를 세는 시스템도, UTF-16 단위를 세는 시스템도, 바이트를 세는 시스템도 있습니다. 실제로 그 앱이 쓰는 기준과 요약 줄을 비교해 보세요.
모든 문자에 스타일이 있지는 않습니다. 악센트가 붙은 글자, 문장 부호 대부분, 다른 문자 체계의 글자에는 볼드나 필기체 형태가 없어서 바뀌지 않고 그대로 나옵니다. 한글도 마찬가지입니다.
스크린 리더와 검색. 보조 기술은 스타일 글자를 수학 기호로 읽거나 건너뛰는 경우가 많고, 검색창 대부분은 이를 일반 단어와 같은 것으로 찾지 못합니다. 중요한 정보는 일반 텍스트로 남겨 두세요.
모양은 글꼴이 결정합니다. 유니코드는 어떤 문자인지만 정하고, 실제 모양은 읽는 사람의 기기에 있는 글꼴이 그립니다. 오래된 기기에서는 빈 네모로 보일 수 있습니다.
보이지 않는 문자. 패널은 눈에 보이지 않는 문자도 드러냅니다. 빈 닉네임이나 간격 꼼수를 다룬다면 투명 글자 생성기에서 각 문자를 설명합니다.
관련 도구
특수문자 폰트 생성기는 이 스타일 위에 장식과 닮은꼴 알파벳을 더합니다. 어떤 스타일이든 되돌리려면 특수 폰트 일반 텍스트 변환기를 쓰세요.