본문으로 건너뛰기
PDF Tools
· PDF Tools · 읽는 데 약 8분

PDF 텍스트를 Word로 가져올 때 레이아웃을 유지하는 방법

PDF 텍스트를 Word에 복사하면 서식이 엉망이 되는 경우가 많습니다. 그 이유와 함께, 단락·글꼴·표를 그대로 살려서 변환하는 세 가지 방법을 소개합니다.

PDF 텍스트를 Word로 가져올 때 레이아웃을 유지하는 방법

PDF 텍스트를 그냥 복사해서 붙여넣으면 서식이 망가지는 이유

누구나 처음엔 같은 방법을 씁니다. PDF를 열고, 전체 선택 후 복사해서 Word에 붙여넣기. 그런데 결과는 거의 항상 엉망입니다. 단락이 이상한 곳에서 끊기고, 표는 정렬도 맞지 않는 숫자 덩어리로 흩어지고, 한영 자간도 뒤죽박죽이 됩니다.

이건 여러분 잘못이 아닙니다. PDF는 Word처럼 '단락'이나 '표'를 저장하는 형식이 아닙니다. PDF가 저장하는 건 그래픽 명령어입니다. "이 글자를 좌표 (x, y)에 그려라"는 식이죠. 텍스트를 복사하면 좌표 위치에서 끌어모은 문자열만 얻게 되고, 단락 구조는 처음부터 파일 안에 존재하지 않습니다.

그래서 항상 같은 방식으로 망가집니다.

  • 줄 끝마다 강제 줄바꿈이 생깁니다. PDF에서는 각 줄이 독립된 텍스트 스트림이라 Word가 단락을 자연스럽게 흘릴 수 없기 때문입니다.
  • 표가 무너집니다. 열 정렬이 사실 글자 사이의 공백일 뿐이기 때문입니다.
  • Word에서 찾을 수 있는 대체 글꼴로 바뀌어 외형이 크게 달라질 수 있습니다.
  • 다단 레이아웃이 완전히 뒤섞입니다. 텍스트를 좌표 기준으로 위에서 아래로 끌어오기 때문에 두 열의 내용이 뒤죽박죽 섞입니다.

레이아웃을 실제로 유지하는 세 가지 방법

방법 1: 전용 변환 도구 사용하기

가장 수고가 적고 정확도도 높습니다. 제대로 된 PDF to Word 도구는 PDF 내부 구조를 읽어서 단락 논리를 재구성하고, 표의 경계를 인식하며, 제목 계층을 보존합니다. 단순히 텍스트를 쏟아내는 게 아닙니다.

100% 완벽한 복원을 기대하기는 어렵고, 디자인이 복잡한 레이아웃일수록 더 힘듭니다. 하지만 단락, 굵은 글씨·기울임꼴, 간단한 표는 대부분 살아남고, 사후 정리 시간이 한 시간에서 몇 분으로 줄어듭니다.

몇 가지 팁을 드리자면, .docx 형식으로 출력하는 도구를 선택하세요. 복잡한 레이아웃 지원이 부실한 구형 .doc 형식은 피하는 게 좋습니다. 변환 후에는 Word의 '스타일' 패널을 열어 제목 계층이 제대로 적용됐는지 확인하세요. 표가 있다면 열 수가 맞는지 먼저 확인한 다음 숫자를 검토하세요.

방법 2: 이미지로 변환한 뒤 필요한 페이지만 골라서 변환하기

일부 페이지의 텍스트만 필요하다면, PDF to JPG로 문서를 이미지로 내보내서 각 페이지 레이아웃을 확인한 후 변환할 페이지를 정하세요. 40페이지짜리 보고서에서 표지, 목차, 부록은 필요 없고 3~7페이지 내용만 필요한 경우에 특히 유용합니다.

방법 3: Word의 찾기·바꾸기로 강제 줄바꿈 정리하기

이미 변환했는데 줄 끝마다 줄바꿈 기호가 남아 있다면 Word에서 일괄 처리할 수 있습니다.

  1. Ctrl+H를 눌러 찾기·바꾸기 창을 엽니다.
  2. '찾을 내용'에 ^p^p(연속된 단락 기호 두 개, 즉 단락 사이의 빈 줄)를 입력합니다.
  3. 이것을 충돌할 일 없는 표시자, 예를 들어 @@@로 바꿉니다.
  4. 남아 있는 ^p를 모두 공백으로 바꿉니다.
  5. 마지막으로 @@@를 다시 ^p로 바꿉니다.

다섯 단계지만 효과가 있고, 한 줄씩 수동으로 지우는 것보다 훨씬 빠릅니다.

PDF 종류에 따라 다른 변환 방법

방법을 고르기 전에 어떤 종류의 PDF인지 먼저 확인하세요. 뷰어에서 마우스로 텍스트 한 줄을 드래그해서 선택해 보세요.

정상적으로 선택이 된다면 원본 PDF입니다. 소프트웨어에서 직접 출력한 것(예: Word에서 저장하거나 InDesign에서 내보낸 것)으로, 내부에 완전한 텍스트 데이터가 있습니다. PDF to Word 변환이 이 유형에서 가장 잘 작동하며 레이아웃 보존도 가장 뛰어납니다.

선택이 안 되거나 선택해도 깨진 문자가 나온다면 스캔 PDF입니다. 스캔 PDF는 본질적으로 이미지 묶음으로, 내부에 추출할 텍스트 데이터가 없습니다. 일반 변환 도구로는 처리할 수 없고 OCR(광학 문자 인식) 전용 도구가 필요합니다.

양식형 PDF는 그 중간입니다. 필드에 입력은 가능하지만 레이아웃이 고정돼 있습니다. Word로 변환하면 표 구조를 수동으로 좀 더 다듬어야 하고, 필드 순서를 하나씩 확인하는 것이 좋습니다.

변환 후 확인해야 할 사항

변환이 끝났다고 바로 쓸 수 있는 건 아닙니다. 5분만 투자해서 확인하면 나중에 생길 번거로움을 미리 막을 수 있습니다.

  • 단락이 의미상 마침표에서 끊기는지, 줄이 꽉 찼을 때 끊기는 건 아닌지 확인하세요.
  • 제목에 실제로 H1/H2/H3 스타일이 적용됐는지 확인하세요. 단순히 굵은 본문이면 안 됩니다.
  • 표의 열이 맞는지, 특히 셀 병합이 있는 표는 꼼꼼히 확인하세요.
  • 이미지가 함께 넘어왔는지 확인하세요. 도구마다 다릅니다.
  • 네모 기호나 깨진 글자가 없는지 확인하세요. 있다면 글꼴이 맞지 않는 것이므로 수동으로 글꼴을 바꿔야 합니다.

정리가 끝나면 공유하기 전에 Word to PDF로 한 번 내보내서 최종 모양을 확인하세요. 그래야 완성된 버전을 전달할 수 있습니다.

자주 필요한 다른 PDF 작업

  • 여러 보고서를 하나로 합쳐야 할 때: PDF 병합으로 페이지 순서를 정해 한 번에 묶을 수 있습니다.
  • 파일이 너무 커서 전송이 안 될 때: PDF 압축으로 용량을 줄이면서 가독성을 유지할 수 있습니다.
  • 서식 없이 순수 텍스트만 필요할 때: PDF to Text.txt 파일을 직접 출력할 수 있어 데이터 처리에 편리합니다.

편집 가능한 문서를 얻는 것이 목표라면, PDF to Word로 시작해서 변환 후 정리하는 것이 가장 빠른 방법입니다.

공유: