줄바꿈 제거 도구가 하는 일
줄바꿈은 한 줄을 끝내고 새 줄을 시작하는 보이지 않는 문자입니다. 엔터 키를 누를 때마다 하나씩 들어갑니다. 그런데 줄바꿈이 엉뚱한 곳에 들어간 텍스트가 있습니다. PDF에서 복사한 모든 줄, 오래된 이메일의 인용 답장, 폭이 좁은 웹페이지 단에서 가져온 글, 자막, 한 줄만 받아야 하는 칸에 붙여넣은 시가 그렇습니다.
이 도구는 그런 줄바꿈을 제거하고 줄을 다시 정상적인 문장으로 이어 붙입니다. 엔터를 하나하나 지울 필요가 없습니다. 줄바꿈 자리에 무엇을 넣을지, 문단을 따로 둘지는 직접 고릅니다.
사용 방법
- 줄바꿈이 있는 텍스트 칸에 텍스트를 붙여넣습니다.
- 줄바꿈 대신 넣을 문자에서 공백, 없음, 쉼표 중 하나를 고릅니다.
- 문단마다 한 줄씩 남기려면 문단 구분 유지를 켭니다.
- 긴 영어 단어가 줄 끝에서 나뉜 PDF나 책의 텍스트라면 하이픈으로 나뉜 단어 잇기를 켭니다.
- 이중 공백 제거는 기본으로 켜져 있어서, 끝에 공백이 있던 줄을 이어도 틈이 두 칸이 되지 않습니다.
- 복사 또는 다운로드를 눌러 결과를 가져갑니다.
도구 아래의 안내 문구에 지운 줄바꿈의 개수가 표시됩니다.
예시
아래 결과는 모두 이 도구로 만든 것입니다. 입력 열의 ¶ 기호는 줄바꿈을 나타냅니다.
| 입력 | 설정 | 결과 |
|---|---|---|
| Dear team, ¶ the meeting moved ¶ to Friday. | 공백 | Dear team, the meeting moved to Friday. |
| apple ¶ banana ¶ cherry | 쉼표 | apple, banana, cherry |
| ABC ¶ 123 ¶ XYZ | 없음 | ABC123XYZ |
| The results were in- ¶ conclusive at first. | 하이픈으로 나뉜 단어 잇기 | The results were inconclusive at first. |
| 이 문단은 PDF에서 ¶ 복사해서 줄마다 ¶ 줄바꿈이 들어가 ¶ 있습니다. | 공백 | 이 문단은 PDF에서 복사해서 줄마다 줄바꿈이 들어가 있습니다. |
| 사과 ¶ 바나나 ¶ 체리 | 쉼표 | 사과, 바나나, 체리 |
조금 더 긴 예도 있습니다. 이 페이지의 예시 텍스트는 PDF에서 복사한 두 문단으로, 모두 일곱 줄입니다. 기본 설정에서는 줄바꿈 여섯 개가 모두 사라지고 긴 한 줄이 되며, 안내 문구에 “줄바꿈 6개를 제거했습니다.”라고 나옵니다. 문단 구분 유지를 켜면 줄바꿈 네 개가 지워지고, 빈 줄로 나뉜 깔끔한 두 문단이 남습니다.
이 문단은 PDF에서 복사해서 줄마다 없어야 할 줄바꿈이 들어 있습니다.
두 번째 문단에도 같은 문제가 있습니다.
작동 원리
도구는 줄바꿈마다 텍스트를 나누고 각 줄의 앞뒤 공백을 잘라 냅니다. 빈 줄은 버립니다. 그런 다음 고른 구분 문자로 줄을 잇습니다. 문단 구분 유지가 켜져 있으면 먼저 빈 줄을 기준으로 텍스트를 나누고, 문단마다 따로 이은 뒤, 문단 사이에 빈 줄을 하나씩 넣어 다시 합칩니다.
하이픈 옵션은 문자, 하이픈, 줄바꿈, 소문자가 차례로 오는 경우를 찾습니다. 이 패턴만 이어 붙이므로, 한 줄 끝의 “well-” 다음 줄이 “Known”으로 시작하면 그대로 둡니다. 줄바꿈 뒤에 대문자가 오면 대개 원래 있던 하이픈이기 때문입니다.
Windows의 줄 끝 문자(두 글자)와 예전 Mac의 줄 끝 문자도 일반 줄바꿈과 똑같이 처리합니다.
한국어 텍스트에서 알아 둘 점
한국어 PDF는 단어 중간에서 줄이 바뀌는 경우가 많습니다. 이 도구는 줄 사이에 공백을 넣을지 말지를 줄마다 판단하지 않고, 고른 구분 문자를 모든 줄 사이에 똑같이 넣습니다. 이 도구로 실행해 보면 “두 번째 문단 ¶ 입니다.”는 공백으로 이으면 “두 번째 문단 입니다.”가 됩니다. 반대로 없음을 고르면 어절 사이에서 끊긴 줄까지 붙어 버립니다.
- 대부분의 줄이 어절 사이에서 끊겼다면 공백을 고르고, 단어 중간에 생긴 공백 몇 군데를 직접 고칩니다.
- 대부분의 줄이 단어 중간에서 끊겼다면 없음을 고르고, 붙어 버린 띄어쓰기를 직접 고칩니다.
- 하이픈 옵션은 영어처럼 하이픈을 붙여 단어를 나누는 경우에만 동작합니다.
팁과 한계
- 하이픈이 들어간 단어를 확인합니다. “self-”와 “employed”처럼 원래 하이픈이 있는 합성어가 두 줄로 나뉘어 있으면, 하이픈 옵션을 켰을 때 “selfemployed”로 이어집니다. 하이픈이 들어간 용어가 많은 글이라면 결과를 한 번 읽어 봅니다.
- 제목이 문단에 붙어 버립니다. 마침표가 없는 PDF 제목은 첫 문장과 이어집니다. 붙여넣기 전에 제목 뒤에 마침표나 빈 줄을 넣어 두면 됩니다.
- 목록은 모양이 사라집니다. 공백으로 잇는 방식은 줄글에는 맞지만 글머리 기호 목록에는 맞지 않습니다. 목록이라면 쉼표가 더 깔끔합니다.
- 줄 안의 탭과 이중 공백은 줄바꿈이 아닙니다. 이런 공백은 공백 제거로 정리합니다.
다른 방법
Microsoft Word: 찾기 및 바꾸기(Ctrl+H)를 열고 찾을 내용에 ^p, 바꿀 내용에 공백을 입력한 뒤 모두 바꾸기를 누릅니다. 문단을 남기려면 먼저 ^p^p를 ### 같은 임시 표시로 바꾸고, 다음으로 ^p를 공백으로, 마지막으로 ###을 ^p^p로 바꿉니다.
Excel과 Google 스프레드시트: 셀 하나 안의 텍스트라면 =SUBSTITUTE(A1, CHAR(10), " ")로 줄바꿈을 공백으로 바꿉니다.
코드: JavaScript에서는 text.replace(/\s*\n\s*/g, ' ')로 기본적인 처리를 할 수 있습니다. Python에서는 ' '.join(text.split())가 모든 것을 공백 하나로 이어 붙입니다.
웹페이지에서 복사한 텍스트에는 HTML 태그나 마크다운 기호가 함께 딸려 오는 경우가 많습니다. 텍스트 서식 제거로 그런 기호를 지우고, 일반 텍스트 변환기로 둥근 따옴표, 특수 폰트, 숨은 문자를 정리할 수 있습니다.