본문으로 건너뛰기
PDF Tools
· PDF Tools · 읽는 데 약 9분

PDF 텍스트를 복사하면 깨지는 이유와 해결 방법

PDF에서 텍스트를 복사해 Word나 메모장에 붙여넣으면 이상한 문자가 나타나나요? 세 가지 주요 원인을 분석하고 실제로 바로 적용할 수 있는 해결 방법을 알려드립니다.

PDF 텍스트를 복사하면 깨지는 이유와 해결 방법

PDF에서 복사한 텍스트가 깨지는 이유

PDF를 열면 멀쩡하게 보이는데, 복사해서 붙여넣으면 물음표·네모 상자·의미 없는 기호가 잔뜩 나타나는 경험, 한 번쯤 해보셨을 겁니다. 이 문제를 해결하려면 먼저 원인을 제대로 파악해야 합니다.

원인 1: 폰트 임베딩 방식의 문제

PDF 형식은 Word처럼 '순수 텍스트'를 저장하는 게 아니라, '페이지 위에 글자를 어떻게 그릴지'에 대한 명령어를 저장합니다. 문서 작성자가 PDF를 내보낼 때 **서브셋 폰트(subset font)**를 사용했다면, PDF 내부의 문자 매핑이 재인코딩되어 각 문자에 할당된 Unicode 코드 포인트가 원래 글자와 전혀 다를 수 있습니다.

결과적으로 화면에는 '보고서'로 보이지만, PDF 내부에는 전혀 다른 Unicode 값이 저장되어 있어 복사하면 깨진 문자가 나타납니다.

원인 2: 스캔본 PDF(이미지 PDF)

가장 흔한 경우 중 하나입니다. 종이 문서를 스캔해서 PDF로 저장하면, 각 페이지는 사실상 이미지일 뿐 복사할 수 있는 텍스트 레이어가 존재하지 않습니다.

Acrobat이나 브라우저에서 '텍스트 복사'를 시도해도 소프트웨어가 제대로 읽지 못하기 때문에, 붙여넣으면 공백이나 깨진 문자만 나오는 것입니다.

원인 3: PDF 복사 보호 설정

일부 PDF에는 **문서 보호(document restriction)**가 적용되어 '콘텐츠 복사 불가'로 명시적으로 설정되어 있습니다. 이런 PDF는 Acrobat에서 우클릭해도 복사 버튼이 비활성화되거나, 복사 자체는 됐지만 붙여넣으면 아무것도 나오지 않습니다.

원인 4: 한국어·한자 폰트 매핑 오류

특히 한국어 문서의 경우, 구버전 소프트웨어(예: 예전 Mac용 Word, 일부 Linux 조판 도구)로 내보낸 PDF는 비표준 한글 폰트 인코딩을 사용할 수 있습니다. 이 경우 PDF 리더가 문자를 정확하게 역변환하지 못해, 복사한 한글이 전부 깨진 문자나 영문 기호로 바뀝니다.


실제 해결 방법: 원인별 맞춤 처방

해결 방법 1: 다른 PDF 리더로 열어보기

같은 PDF라도 다른 소프트웨어로 열면 복사 결과가 달라질 수 있습니다. 다음 프로그램들을 시도해보세요.

  • 브라우저 내장 PDF 리더 (Chrome, Firefox, Edge)
  • Adobe Acrobat Reader (무료 버전)
  • macOS 미리보기(Preview)
  • Foxit Reader

특정 소프트웨어에서 정상적으로 복사된다면, 기존에 사용하던 리더의 디코딩 성능이 부족한 것입니다.

해결 방법 2: PDF를 텍스트 파일로 변환하기

가장 직접적인 방법은 PDF의 텍스트 레이어를 통째로 추출하는 것입니다. PDF to Text 도구를 사용하면 PDF 내의 텍스트 내용을 순수 .txt 파일로 저장할 수 있습니다. 텍스트 레이어가 올바르게 존재하는 PDF라면 거의 100% 효과가 있으며, 리더 소프트웨어의 인코딩 문제에도 영향을 받지 않습니다.

사용 방법도 간단합니다. PDF 업로드 → 변환 대기 → .txt 파일 다운로드 → 필요한 부분 복사.

해결 방법 3: Word로 변환 후 복사하기

순수 텍스트가 아닌 단락 구조까지 유지해야 한다면, PDF to Word 도구를 사용해 PDF를 편집 가능한 .docx 파일로 변환한 뒤 Word에서 복사하세요.

텍스트 레이어가 올바른 PDF에서는 이 방법이 잘 작동하며, 단락·굵은 글씨·제목 구조 대부분이 유지되어 직접 복사·붙여넣기보다 훨씬 깔끔한 결과를 얻을 수 있습니다.

해결 방법 4: 스캔본 PDF는 어떻게 처리하나요?

스캔본 PDF(이미지 PDF)는 처리가 까다롭습니다. 문서 안에 텍스트 자체가 없기 때문에 OCR(광학 문자 인식) 기술로 다시 인식해야 합니다.

현재 본 사이트의 도구는 텍스트 레이어가 있는 PDF를 중심으로 제공됩니다. 스캔본 PDF라면 다음 대안을 고려해보세요.

  • Google Drive: PDF를 Google Drive에 업로드한 뒤 우클릭 → 'Google 문서로 열기'를 선택하면 내장 OCR 기능으로 한국어 인식이 가능합니다.
  • Adobe Acrobat Pro: 유료 버전에 완전한 OCR 기능이 포함되어 있습니다.
  • Microsoft OneNote: 이미지를 붙여넣은 뒤 우클릭 → '그림 속 텍스트 복사'를 선택하면 여러 언어를 지원합니다.

해결 방법 5: PDF 페이지를 이미지로 변환해서 확인하기

자신의 PDF가 '이미지 PDF'인지 '텍스트 레이어가 있는 PDF'인지 확실하지 않다면, PDF to JPG 도구로 각 페이지를 이미지로 변환해보세요. 출력된 이미지가 선명하게 보이면 스캔본 이미지 PDF이고, 텍스트가 벡터 형태라 확대해도 깨지지 않는다면 실제 텍스트 레이어가 있는 PDF입니다.

이 방법으로 문서 품질을 확인하고 이후 처리 방향을 결정하는 데 도움을 받을 수 있습니다.


처음부터 깨짐 문제를 예방하는 방법

사후 수습보다는 처음부터 문제를 피하는 것이 좋습니다.

PDF 내보낼 때 주의사항

문서를 직접 만드는 경우, PDF 내보내기 시 다음 사항을 기억하세요.

  • '서브셋만 임베딩' 대신 '전체 폰트 임베딩' 선택: Acrobat과 Word의 내보내기 설정에 모두 이 옵션이 있습니다. 폰트를 완전히 임베딩하면 다른 사람이 열 때 문자 매핑이 올바르게 유지됩니다.
  • 복사 보호 설정하지 않기: 꼭 필요한 경우가 아니라면 문서 보호는 수신자에게 큰 불편을 줍니다.
  • Word 또는 Google Docs에서 직접 PDF로 내보내기: 인쇄 → 가상 프린터 방식은 폰트 문제가 더 자주 발생하므로 권장하지 않습니다.

PDF를 받을 때 자가 점검 방법

PDF를 받으면 먼저 리더에서 몇 글자를 선택해보세요. 선택 영역이 각 글자를 정확하게 감싼다면 텍스트 레이어가 있는 것으로, 복사에 문제가 없습니다. 선택 영역이 한 줄 전체나 페이지 전체를 감싸거나 아예 선택이 안 된다면 이미지 PDF일 가능성이 높으므로 OCR 방식으로 처리해야 합니다.

편집 가능한 원본 파일 백업하기

가능하다면 .docx, .xlsx 등 편집 가능한 형식도 함께 보관하세요. Word to PDF를 사용하면 PDF 버전으로 빠르게 변환해 공유할 수 있고, 원본 Word 파일이 있으면 나중에 텍스트를 가져올 때 PDF에 의존하지 않아도 됩니다.


깨짐 문제가 생기면 이 두 가지 도구를 먼저 시도하세요

PDF 텍스트 복사 깨짐 문제는 대부분 '파일 변환'으로 해결할 수 있습니다. 지금 PDF에서 텍스트를 추출해야 한다면 아래 두 가지를 시도해보세요.

  • PDF to Text: 텍스트 레이어를 .txt로 바로 추출합니다. 깔끔하고 빠릅니다.
  • 단락 서식을 유지해야 한다면 PDF to Word로 변환한 뒤 필요한 부분을 복사하세요.

두 도구 모두 별도 소프트웨어 설치 없이 업로드만 하면 바로 사용할 수 있으며, 변환 후 바로 다운로드됩니다. 변환 후에도 여전히 깨진다면, 해당 PDF는 스캔본 이미지 PDF임이 거의 확실하므로 OCR 방식으로 처리해야 합니다.

공유: