
스캔 PDF OCR을 했는데 단어를 검색할 수 없거나, 복사한 문장이 엉뚱하게 붙는다면 파일 안에 글자가 아니라 페이지 이미지가 들어 있을 가능성이 큽니다. 이때 필요한 작업이 OCR(광학 문자 인식)입니다. OCR은 사진이나 스캔 이미지 속 글자를 선택·검색할 수 있는 텍스트로 바꾸지만, 원본 상태가 좋지 않으면 결과도 그대로 흔들립니다.
Adobe의 한국어 안내는 스캔 PDF에 OCR을 적용하면 검색 가능한 텍스트 레이어를 만들 수 있다고 설명하며, OCR 실행 뒤 텍스트가 정확하고 완전한지 검토하라고 권고합니다. Microsoft 공식 안내의 OCR 기능 기준으로 보면 Windows 캡처 도구는 이미지에서 텍스트를 추출하고, 텍스트 인식 프로세스는 기기에서 로컬로 수행됩니다. 도구 이름보다 먼저 확인할 것은 ‘원본을 보존하고, 인식 언어를 맞추고, 중요한 문장을 직접 대조한다’는 순서입니다.
OCR 전에 원본을 한 번 보관하기
원본 PDF를 바로 덮어쓰지 말고 별도 사본을 만듭니다. OCR 결과는 검색성과 편집 편의성을 높여도, 주민등록번호·계좌번호 같은 민감한 정보가 자동으로 가려지지는 않습니다. 공유 목적이라면 원본, OCR 작업본, 외부 공유본을 분리하는 편이 안전합니다.
| 확인 항목 | 작업할 때 볼 점 | 이유 |
|---|---|---|
| 페이지 상태 | 기울어짐·그림자·잘림 여부 | 글자 윤곽이 흐리면 오인식이 늘어날 수 있습니다. |
| 언어 | 한국어·영어 등 실제 문서 언어 | 인식 언어가 맞지 않으면 고유명사와 숫자 오류를 놓치기 쉽습니다. |
| 저장 방식 | 원본과 결과 파일을 다른 이름으로 저장 | 수정 전 자료를 다시 확인할 수 있습니다. |
| 공유 전 검토 | 이름·금액·날짜·번호를 원본과 대조 | 검색 가능해졌다고 내용이 자동으로 정확해지는 것은 아닙니다. |
실전 예시로 세 장짜리 영수증 PDF라면 첫 장의 상호명, 둘째 장의 결제 금액, 셋째 장의 승인 번호를 각각 검색·복사·원본 대조해 봅니다. 한 항목이라도 다르면 같은 파일을 바로 공유하지 말고 해당 페이지의 인식 언어와 촬영 상태를 다시 확인합니다.
스캔 품질을 먼저 다듬는 이유

휴대폰으로 찍은 문서는 종종 한쪽이 어둡거나 책상 그림자가 들어갑니다. Adobe는 스캔 개선 과정에서 페이지 범위와 텍스트 인식 설정을 고를 수 있고, 기울기 보정·배경 제거·텍스트 선명도 같은 조정 항목을 안내합니다. 모든 문서에 같은 값을 적용하기보다, 작은 글자나 표가 있는 한 페이지를 먼저 시험해 보는 편이 낫습니다.
문서가 여러 장이면 첫 페이지 결과만 보고 전체 작업을 확정하지 마세요. 도장, 체크 표시, 손글씨, 접힌 자국은 인식 결과에 영향을 줄 수 있습니다. 특히 표의 열 제목과 금액은 텍스트가 한 줄로 합쳐지지 않았는지 확인해야 이후 엑셀 붙여넣기나 검색에서 혼선을 줄일 수 있습니다.
OCR 실행 뒤에는 세 곳을 대조합니다

Acrobat의 ‘스캔 및 OCR’ 기능에서는 페이지 범위와 언어를 정한 뒤 텍스트 인식을 실행할 수 있습니다. 스캔 PDF OCR 완료 뒤에는 검색창으로 고유명사 하나를 찾아보고, 문장 일부를 복사해 메모장에 붙여넣고, 원본 이미지와 결과를 나란히 비교해 보세요. 이 세 단계가 통과하면 해당 파일이 단순 이미지 PDF인지, 실제로 검색 가능한 PDF인지 빠르게 판단할 수 있습니다.
- 제목·기관명처럼 오타가 나면 곤란한 단어를 검색합니다.
- 날짜·금액·문서번호를 원본 확대 화면과 비교합니다.
- 복사한 표가 열 순서를 유지하는지 확인합니다.
- 오류가 있으면 원본을 다시 촬영하거나 인식 언어·페이지 범위를 조정해 재실행합니다.
휴대폰 캡처 OCR은 짧은 확인에 맞습니다

Windows 캡처 도구의 텍스트 작업처럼 화면 속 문구를 즉시 복사하는 방식은 짧은 안내문이나 한두 줄 확인에 유용합니다. 반면 계약서, 영수증 묶음, 제출 서류처럼 보관·검색·공유가 필요한 자료는 PDF 원본을 따로 저장하고 전체 페이지 OCR 결과를 검토하는 쪽이 낫습니다. 도구가 인식한 결과는 초안으로 보고, 중요한 정보는 반드시 화면 원본과 대조하세요.
공유 전 마지막 점검
OCR을 마친 PDF는 검색창에서 단어가 찾아지는지, 선택한 문장이 자연스럽게 복사되는지, 페이지 순서와 표가 무너지지 않았는지를 확인한 뒤 공유합니다. 민감한 정보가 있으면 가림 처리 여부도 별도로 확인해야 합니다. 검색 가능 PDF는 자료를 찾기 쉽게 만들지만, 정확성·개인정보 보호까지 대신 보장하지는 않습니다.
출처
- Adobe Acrobat, 스캔한 문서에서 텍스트 인식: https://helpx.adobe.com/kr/acrobat/desktop/create-documents/scan-documents-to-pdfs/recognize-text.html
- Adobe Acrobat, 스캔한 문서 개선하기: https://helpx.adobe.com/kr/acrobat/desktop/create-documents/scan-documents-to-pdfs/enhance-scans.html
- Microsoft 지원, 캡처 도구를 사용하여 스크린샷 캡처: https://support.microsoft.com/ko-kr/windows/%EC%BA%A1%EC%B2%98-%EB%8F%84%EA%B5%AC%EB%A5%BC-%EC%82%AC%EC%9A%A9%ED%95%98%EC%97%AC-%EC%8A%A4%ED%81%AC%EB%A6%B0%EC%83%B7-%EC%BA%A1%EC%B2%98-00246869-1843-655f-f220-97299b865f6b