PDF를 Word DOCX로 변환하고 표와 문단을 정확히 검수하는 방법
PDF를 Word로 변환하면 복사해서 다시 입력하는 시간을 줄일 수 있지만, 변환 버튼을 눌렀다고 원본과 같은 편집 문서가 자동으로 완성되는 것은 아닙니다. PDF는 페이지의 최종 모양을 보존하는 형식이고 DOCX는 문단·스타일·표처럼 다시 흐르는 구조를 편집하는 형식이기 때문입니다. 특히 스캔본, 다단 편집, 복잡한 표, 특수 글꼴이 있는 문서는 변환 후 검수가 필수입니다.
이 글은 Adobe Acrobat 데스크톱과 웹의 공식 변환 절차를 기준으로 합니다. 결과 파일을 업무에 쓰기 전에 원본 PDF와 대조하면서 금액, 날짜, 표 셀, 머리글·바닥글, 각주를 확인하는 방법까지 다룹니다. 유료 구독이나 조직 정책에 따라 사용할 수 있는 기능이 다를 수 있으므로 계정의 플랜과 파일 반출 규정을 먼저 확인하세요.
핵심 개념: PDF 페이지를 DOCX 구조로 다시 해석한다
텍스트 기반 PDF에는 글자 정보가 들어 있어 검색과 선택이 가능합니다. 반면 스캐너로 만든 PDF는 페이지 전체가 이미지여서 먼저 OCR로 글자를 인식해야 합니다. Acrobat은 PDF를 Word의 DOCX 또는 구형 DOC로 내보낼 수 있지만, 원본 제작 프로그램의 스타일 이름·수식 구조·표 의미까지 완벽히 복원한다고 보장할 수는 없습니다.
| 원본 유형 | 변환 전 상태 | 예상 결과 | 우선 검수 대상 |
|---|---|---|---|
| Word에서 만든 일반 PDF | 텍스트 선택 가능, 단일 단 | 문단과 제목이 비교적 잘 복원 | 글꼴 대체, 줄바꿈, 페이지 나눔 |
| 스캔 PDF | 글자 선택 불가, 페이지가 이미지 | OCR 정확도에 따라 편차 큼 | 한글·숫자·기호, 표 셀, 기울어진 페이지 |
| 다단 보고서 | 2~3단과 도형 혼합 | 읽기 순서가 섞일 수 있음 | 문단 순서, 텍스트 상자, 캡션 |
| 복잡한 표·양식 | 병합 셀과 선이 많음 | 표가 여러 개로 나뉘거나 텍스트 상자로 변환 | 행·열, 금액 합계, 체크 박스 |
| 보안 설정 PDF | 복사·내보내기 제한 가능 | 권한에 따라 변환 불가 | 문서 속성의 보안 권한과 소유자 승인 |
준비사항: 변환 목적과 완료 기준을 먼저 정한다
단순히 문구 몇 줄만 재사용하려는지, 전체 문서를 편집 가능한 원고로 되살리려는지에 따라 방법이 달라집니다. 일부 텍스트만 필요하면 Acrobat의 선택 도구로 범위를 지정해 선택 영역을 다른 형식으로 내보내기를 쓰는 편이 전체 문서 변환보다 정리가 적을 수 있습니다. 전체 레이아웃을 수정해야 한다면 DOCX 전체 변환을 선택합니다.
원본 PDF를 읽기 전용으로 보관하고 작업 사본을 만듭니다. 개인정보·계약정보가 포함된 문서는 웹 업로드가 허용되는지 조직 정책을 확인합니다. 반출이 금지된 파일은 승인된 데스크톱 환경에서만 작업합니다. 변환 결과 파일명은 원본문서명_DOCX변환_20260803_v01.docx처럼 원본과 구분합니다.
| 준비 항목 | 확인 방법 | 완료 기준 |
|---|---|---|
| 텍스트 여부 | 문장 한 줄을 드래그해 선택 | 선택되면 텍스트 PDF, 안 되면 OCR 검토 |
| 페이지 방향 | 축소판에서 전 페이지 확인 | 거꾸로 된 페이지 없이 방향 통일 |
| 문서 언어 | 한글·영문·숫자 비중 확인 | 변환 또는 OCR 언어와 일치 |
| 보안 권한 | 문서 속성의 보안 탭 확인 | 콘텐츠 복사·내보내기 허용 또는 소유자 승인 |
| 중요 항목 | 금액·날짜·계좌·조항 번호 표시 | 변환 후 전수 대조 목록 준비 |
단계별 절차 1: Acrobat 데스크톱에서 DOCX로 변환한다
- Acrobat에서 작업할 PDF를 엽니다.
- 상단 도구 모음에서 변환을 선택합니다. 환경에 따라 모든 도구 > PDF 내보내기로 표시될 수 있습니다.
- 왼쪽 패널에서 Microsoft Word를 선택합니다.
- 드롭다운에서 DOCX 또는 DOC를 선택합니다. 특별한 구형 시스템 요구가 없다면 XML 기반의 최신 형식인 DOCX를 우선합니다.
- DOCX로 변환을 선택하고 저장 위치와 파일명을 지정합니다.
- 저장된 파일을 Word에서 열고 편집 사용 여부와 글꼴 경고를 확인합니다.
원본 일부만 필요하다면 선택 도구로 텍스트를 표시한 뒤 마우스 오른쪽 버튼을 눌러 선택 영역을 다른 이름으로 내보내기를 이용할 수 있습니다. Adobe 공식 도움말은 선택한 텍스트를 DOCX, DOC, XLSX, RTF, XML, HTML, CSV 등으로 저장할 수 있다고 설명합니다. 표 한 부분만 재사용할 때 유용하지만 이미지와 전체 페이지 구조는 별도로 확인해야 합니다.
단계별 절차 2: Acrobat 웹에서 변환한다
Acrobat 웹 홈에서 변환 > PDF 내보내기를 선택하고 파일 위치에서 PDF를 고릅니다. 내보내기 대화상자에서 Microsoft Word와 DOCX를 선택하고 문서 언어를 지정한 뒤 변환을 실행합니다. 완료된 파일은 화면에서 내려받습니다.
웹 방식은 설치 없이 쓸 수 있지만 파일이 클라우드에 업로드됩니다. 인사자료, 계약서, 고객정보처럼 민감한 내용은 조직의 클라우드 사용 승인을 확인하기 전 업로드하지 않습니다. 또한 Adobe 공식 안내에 표시된 것처럼 일부 변환 형식이나 기능은 구독 플랜이 필요할 수 있습니다. 무료 여부를 추측하지 말고 현재 계정 화면의 제공 범위를 확인합니다.
스캔 PDF라면 OCR을 먼저 점검한다
스캔본은 이미지에서 글자를 인식하는 과정이 필요합니다. 페이지가 기울거나 흐릿하면 OCR 결과의 0/O, 1/l/I, 8/B, 한글 받침, 괄호, 소수점이 틀릴 수 있습니다. 먼저 페이지 방향을 바로잡고 불필요한 여백·그림자를 줄인 사본에서 OCR을 수행합니다. 한국어와 영어가 섞인 문서는 인식 언어를 문서 내용에 맞춥니다.
OCR 후에는 PDF 자체에서 고유명사, 금액, 날짜를 검색해 인식 여부를 표본 확인합니다. 검색되지 않거나 선택한 글자가 화면의 글자와 다르면 곧바로 DOCX로 넘기지 말고 OCR 결과부터 보정합니다. 저해상도 원본을 여러 번 저장해 화질이 더 떨어진 경우 가능하면 최초 스캔 파일로 돌아갑니다.
| OCR 오류 유형 | 발견 방법 | 수정 우선순위 |
|---|---|---|
| 숫자·소수점 오인식 | 합계와 원본 금액 대조 | 최우선, 재무 결과에 직접 영향 |
| 한글 받침 누락 | 고유명사와 핵심 용어 검색 | 계약·인사 문서는 전수 확인 |
| 줄 순서 뒤섞임 | 소리 내어 읽거나 문단 번호 추적 | 다단 문서에서 최우선 |
| 표 셀 이동 | 행·열 머리글을 따라 값 대조 | 셀 병합이 많은 표 전수 확인 |
| 머리글 본문 혼입 | Word 탐색 창과 반복 문구 검색 | 스타일 정리 전에 분리 |
변환 후 1차 검수: 페이지와 읽기 순서를 비교한다
PDF와 DOCX를 나란히 열고 같은 확대 비율로 첫 페이지, 중간 페이지, 마지막 페이지를 먼저 비교합니다. 페이지 수가 달라지는 것 자체는 오류가 아닙니다. DOCX는 글꼴과 여백에 따라 다시 흐르기 때문입니다. 대신 제목 뒤 본문이 이어지는지, 다단 문서의 읽기 순서가 왼쪽 위에서 오른쪽 아래로 자연스러운지 확인합니다.
Word의 탐색 창에서 제목처럼 보이는 문단이 실제 제목 스타일로 인식되는지 봅니다. 변환 과정에서 모든 줄이 일반 문단이나 텍스트 상자로 들어왔다면, 먼저 제목 1·제목 2·본문 스타일을 다시 정의합니다. 수동으로 글꼴 크기만 반복 변경하면 이후 목차와 레이아웃 관리가 어려워집니다.
머리글과 바닥글, 페이지 번호가 본문 문단으로 반복 삽입되었는지 검색합니다. 반복 문구를 한꺼번에 바꾸기 전에 실제 본문에도 같은 문구가 있는지 확인하고, 머리글 영역으로 옮긴 뒤 구역별 페이지 번호가 맞는지 점검합니다.
변환 후 2차 검수: 표·이미지·각주를 확인한다
표는 셀 수만 보지 말고 머리글과 값의 관계를 확인합니다. 병합 셀이 풀리면 값이 옆 열로 밀릴 수 있고, 페이지를 넘긴 표가 두 개의 표로 분리될 수 있습니다. 금액표는 행 합계와 열 합계를 다시 계산해 원본의 총계와 일치하는지 확인합니다. 표를 다시 만드는 편이 빠른 경우에는 원본을 기준으로 새 표를 만들고 변환된 값만 검증해 옮깁니다.
이미지가 잘렸거나 겹치면 Word의 텍스트 배치 옵션을 확인합니다. 중요한 도표는 원본 PDF에서 충분한 품질로 다시 추출하거나 제작 원본을 요청하는 것이 좋습니다. 화면 캡처를 반복하면 해상도가 낮아지고 출처 관리가 어려워집니다.
각주 번호가 일반 위 첨자 텍스트로만 변환되면 Word의 각주 기능과 연결되지 않습니다. 각주 수가 적다면 정식 각주로 다시 삽입하고 번호와 본문을 대조합니다. 수식은 문자와 그림이 섞일 수 있으므로 계산에 쓰일 문서라면 원본 수식 파일을 요청하거나 직접 재작성합니다.
구체적인 사례: 30쪽 용역 보고서를 편집본으로 복원하기
30쪽짜리 텍스트 기반 보고서에 표 12개, 그림 8개, 각주 20개가 있다고 가정합니다. 먼저 원본 PDF의 SHA 또는 파일 속성 정보를 기록하고 작업 사본을 만듭니다. Acrobat에서 DOCX로 변환한 뒤 Word에서 제목 스타일과 본문 스타일을 먼저 정리합니다. 그 다음 페이지 단위가 아니라 검수 대상 단위로 작업합니다.
1차 담당자는 제목 계층, 문단 순서, 머리글·바닥글을 확인합니다. 2차 담당자는 표의 행·열과 모든 숫자를 원본과 대조합니다. 3차 담당자는 그림 번호, 캡션, 각주 연결을 봅니다. 마지막으로 PDF로 다시 내보내 원본과 페이지별 시각 차이를 확인합니다. 이 방식은 한 사람이 처음부터 끝까지 눈으로만 넘기는 것보다 누락 원인을 기록하기 쉽습니다.
검수 기록표에는 원본 PDF 페이지, DOCX 위치, 항목, 오류, 수정자, 확인자, 완료일을 둡니다. 예를 들어 “PDF 14쪽 표 6의 총액 12,450,000원”처럼 원본 근거를 적으면 수정 후 재검증이 가능합니다.
자주 발생하는 문제와 해결표
| 증상 | 가능 원인 | 해결 방법 |
|---|---|---|
| 글자가 이미지로만 들어옴 | 원본이 스캔본이거나 OCR 미적용 | 원본 사본에서 올바른 언어로 OCR 후 재변환 |
| 문단 순서가 뒤섞임 | 다단·텍스트 상자 레이아웃 | 원본 읽기 순서대로 문단을 재배치하고 스타일 적용 |
| 표가 여러 조각으로 나뉨 | 페이지 경계, 병합 셀, 복잡한 선 | 표를 새로 만들고 원본 값과 합계를 전수 대조 |
| 글꼴과 줄바꿈이 크게 달라짐 | 원본 글꼴 미설치 또는 글꼴 대체 | 허용된 글꼴 설치 여부 확인, 표준 글꼴로 스타일 재정의 |
| 변환 메뉴가 없거나 실패 | Reader 기능 범위, 구독, 보안 권한, 손상 파일 | 계정 플랜과 PDF 보안 속성 확인, 정상 사본에서 재시도 |
| 한글과 숫자가 틀림 | OCR 언어·해상도 문제 | 한국어 포함 언어 설정 후 OCR 재실행, 중요 값 수동 대조 |
| 파일 크기가 지나치게 커짐 | 페이지 이미지가 고해상도로 포함 | 최종 검수 후 이미지 압축, 원본 품질 보존 사본 별도 유지 |
| 링크·각주가 작동하지 않음 | 시각적 텍스트로만 변환 | Word의 하이퍼링크·각주 기능으로 다시 연결 |
실무 팁: 변환보다 검수 시간을 먼저 예산화한다
원본이 복잡할수록 버튼을 누르는 시간보다 구조를 고치는 시간이 훨씬 깁니다. 5쪽 표본을 먼저 변환해 한 페이지당 검수 시간을 측정한 뒤 전체 일정을 산정합니다. 표본에서 읽기 순서와 표 복원이 나쁘다면 전체 자동 변환을 강행하지 말고 원본 편집 파일을 요청하거나 필요한 부분만 재작성합니다.
찾기 기능으로 날짜 패턴, 통화 기호, %, 조항 번호를 검색해 중요 값을 빠르게 표본화합니다. 문서의 핵심 용어 목록을 만들어 OCR 오탈자를 일괄 찾되, 무조건 바꾸기는 피합니다. 같은 문자열이 사람 이름과 일반 단어에 동시에 쓰일 수 있기 때문입니다.
수정 완료본을 다시 PDF로 내보내 시각 검수용 파일을 만듭니다. 원본과 새 PDF를 나란히 놓고 페이지 축소판, 표 위치, 캡션, 페이지 번호를 확인합니다. 이 재출력 PDF는 편집 원본 DOCX를 대신하지 않으며 검수 증적용으로 보관합니다.
한계와 주의사항
PDF에서 DOCX로 변환하는 것은 원본 Word 파일을 복구하는 것과 같지 않습니다. 원래의 스타일 정의, 변경 내용 추적 기록, 메타데이터, 연결된 데이터, 수식 의미가 소실될 수 있습니다. 법적 효력이 있는 계약서나 서명 문서는 변환본을 원본으로 대체하지 말고 승인된 PDF를 기준 문서로 유지합니다.
저작권이 있는 자료는 편집 가능한 형식으로 변환할 권한이 있는지 확인합니다. 암호나 복사 제한을 우회하지 말고 문서 소유자에게 권한을 요청합니다. 웹 변환은 편리하지만 민감정보 업로드와 데이터 처리 위치가 조직 정책에 맞는지 확인해야 합니다.
복잡한 도면, 악보, 수학식, 세로쓰기, 낮은 해상도 스캔은 자동 변환 정확도가 낮을 수 있습니다. 중요한 수치가 있는 문서는 사람의 교차 검토를 생략하지 않습니다.
최종 체크리스트
- 변환 목적이 전체 편집인지 일부 텍스트 재사용인지 정했다.
- 원본 PDF를 보존하고 별도의 작업 사본을 만들었다.
- 텍스트 PDF와 스캔 PDF를 구분하고 필요하면 OCR을 먼저 적용했다.
- DOC 대신 DOCX를 기본 출력으로 선택했다.
- 문서 언어를 실제 내용에 맞게 설정했다.
- 제목 계층, 문단 읽기 순서, 머리글·바닥글을 확인했다.
- 표의 행·열, 금액, 날짜, 합계를 원본과 대조했다.
- 이미지, 캡션, 하이퍼링크, 각주, 수식을 확인했다.
- 수정본을 다시 PDF로 내보내 시각적으로 비교했다.
- 변환본이 원본 PDF를 대체하지 않도록 버전과 보관 위치를 구분했다.
- 민감정보와 저작권, 구독 및 보안 권한을 확인했다.
공식 자료와 확인일
- Adobe Acrobat, *PDF를 Word 형식으로 변환하세요*: https://helpx.adobe.com/kr/acrobat/desktop/save-export-documents/convert-to-other-formats/pdf-to-word.html (확인일 2026-08-03)
- Adobe Acrobat, *Convert or export PDFs to other file formats*: https://helpx.adobe.com/acrobat/using/exporting-pdfs-file-formats.html (확인일 2026-08-03)
- Adobe Acrobat on the web, *Export PDFs to other formats*: https://helpx.adobe.com/acrobat/web/share-review-and-export/export-and-print/export-pdfs.html (확인일 2026-08-03)
