본문 바로가기

PDF 글자가 선택되지 않을 때 스캔·OCR·보안 설정 구분법

공식 문서 검증작성 SW픽 편집부 · 발행
프로그램
Adobe Acrobat
환경
Windows·macOS Acrobat 공식 절차
버전
Adobe Acrobat 데스크톱 · 2025-11~2026 공식 도움말 기준
최종 검증일

Adobe 공식 문서 3건에서 이미지 전용 PDF, OCR 인식 오류와 접근성·보안 제한을 대조했습니다. 실제 문서 OCR 정확도 시험은 포함하지 않았습니다.

PDF 글자가 선택되지 않을 때 스캔·OCR·보안 설정 구분법의 손실 방지와 복구 기준을 요약한 대표 이미지

PDF에서 글자를 드래그해도 선택되지 않는다고 모두 OCR이 필요한 것은 아닙니다. 종이를 스캔해 페이지 전체가 이미지인 경우, 작성자가 복사·추출을 제한한 경우, 텍스트는 있지만 글꼴 인코딩 때문에 복사 결과가 깨지는 경우가 서로 다릅니다. 보안 제한을 우회하려 하거나 이미 텍스트가 있는 문서에 OCR을 반복하면 품질과 문서 구조가 더 나빠질 수 있습니다.

아래 내용은 Adobe Acrobat의 OCR, 인식 오류 수정과 접근성 안내를 대조한 진단 순서입니다. 실제 문서의 언어·해상도별 인식률을 시험한 결과는 아닙니다.

PDF 텍스트 선택 실패를 이미지 스캔, 보안 제한, 인식 오류로 나누는 흐름
텍스트가 선택되지 않는 원인을 세 갈래로 구분한 설명용 개념도이며 실제 Acrobat 화면은 아닙니다.

1단계: 페이지가 이미지인지 먼저 확인합니다

페이지를 크게 확대했을 때 글자 가장자리까지 사진처럼 흐려지고 한 글자도 커서로 선택되지 않으면 이미지 전용 PDF일 가능성이 큽니다. Acrobat의 문서 속성에서 글꼴 목록이 비어 있는지도 참고할 수 있습니다. 반대로 일부 글자는 선택되거나 검색되는데 복사 결과만 깨지면 OCR보다 글꼴·인코딩 문제를 의심합니다.

2단계: 보안 제한을 구분합니다

문서 속성의 보안 탭에서 “콘텐츠 복사” 또는 편집 허용 상태를 확인합니다. 작성자가 암호나 권한으로 복사를 제한했다면 정당한 권한 없이 우회해서는 안 됩니다. 원본 제공자에게 텍스트가 포함된 접근 가능한 파일이나 권한이 허용된 사본을 요청합니다. Adobe 안내상 화면 읽기 프로그램은 신뢰할 수 있는 에이전트로 처리될 수 있지만, 일반 복사·인쇄 제한이 자동으로 해제된다는 뜻은 아닙니다.

원인별 선택

진단 결과 적절한 조치 피해야 할 조치
페이지 전체가 이미지 원본 사본에서 OCR 실행 원본을 덮어쓰기
복사 보안 제한 권한 있는 파일 요청 암호·제한 우회
텍스트는 선택되나 깨짐 다른 뷰어·원본 내보내기 확인 무조건 재OCR
일부 페이지만 이미지 대상 페이지만 범위 지정 문서 전체 반복 처리

3단계: OCR은 복사본에서 언어와 범위를 지정합니다

Adobe는 스캔 PDF를 편집하기 전에 원본 백업 사본을 만들 것을 권장합니다. Acrobat에서 모든 도구 → 스캔 및 OCR → 이 파일에서를 열고 페이지 범위와 문서 언어를 선택한 뒤 텍스트 인식을 실행합니다. 한글과 영문이 섞인 문서는 주요 언어를 정확히 고르고 표, 각주와 세로쓰기 페이지를 별도로 확인합니다.

OCR은 이미지 위 또는 아래에 검색 가능한 텍스트 층을 만듭니다. 화면에 보이는 글자와 복사되는 글자가 다를 수 있으므로 검색만 된다고 완료된 것은 아닙니다.

4단계: 인식이 불확실한 단어를 검수합니다

인식된 텍스트 수정 도구에서 검토 옵션을 켜면 Acrobat이 확신하지 못한 단어를 표시할 수 있습니다. 원래 이미지와 “인식 결과”를 비교해 사람 이름, 숫자, 계좌·계약 번호, 날짜와 단위를 우선 수정합니다. 자동 교정만 믿고 원문 의미가 달라진 문서를 배포하지 마십시오.

접근성까지 확인합니다

텍스트 선택은 접근성의 한 요소일 뿐입니다. 이미지 전용 PDF를 OCR로 바꾼 뒤 제목, 읽기 순서, 표 구조, 이미지 대체 텍스트와 문서 언어가 적절한지 접근성 검사를 실행합니다. 화면 읽기 프로그램으로 핵심 문단과 표를 표본 확인하면 단순 검색 가능 여부보다 실제 이용 가능성을 더 잘 판단할 수 있습니다.

정상 완료 기준

  • 텍스트 검색과 선택이 가능하고 복사 결과가 화면 내용과 일치합니다.
  • 중요한 이름·숫자·날짜를 원본 이미지와 대조했습니다.
  • 원본 스캔 파일과 OCR 처리본을 별도로 보존했습니다.
  • 보안 제한을 우회하지 않았고 필요한 경우 권리자에게 허용된 사본을 요청했습니다.

OCR 오류가 계속될 때

해상도가 낮거나 기울어진 원본은 더 선명한 재스캔을 요청하는 편이 정확합니다. Acrobat이 “렌더링 가능한 텍스트가 이미 있다”고 알리면 문서에 텍스트 층이 존재하는지 확인하고 중복 OCR을 멈춥니다. 법적 효력이 있는 문서는 OCR 결과를 원본으로 대체하지 말고 원본 이미지와 함께 보관하십시오.

OCR 실행 전 원본 품질을 평가합니다

낮은 해상도, 기울어진 페이지, 비치는 뒷면, 손글씨와 복잡한 표는 언어를 맞춰도 오인식 위험이 큽니다. 확대해 한글 받침, 숫자 0과 영문 O, 1과 I가 구분되는지 확인합니다. 원본 종이가 있다면 재스캔 해상도와 기울기 보정을 개선하는 편이 반복 OCR보다 낫습니다. 문서가 이미 전자적으로 생성됐다면 작성 앱에서 태그가 포함된 PDF를 다시 내보낼 수 있는지도 먼저 요청합니다.

표본 영역 우선 검수 항목 오류 영향
제목·목차 검색어와 문서 구조 탐색 실패
이름·주소 고유명사와 띄어쓰기 당사자 오인
금액·날짜·단위 숫자, 소수점, 통화 기호 계약·회계 오류
표·각주 셀 순서와 읽기 순서 문맥 왜곡

민감 문서 처리 원칙

계약서·신분증·의료 문서는 승인된 로컬 또는 조직 환경에서만 처리하고, 편의를 위해 공개 웹 변환 서비스에 올리지 않습니다. OCR 처리본에는 원본에 없던 검색 가능한 개인정보 층이 생길 수 있으므로 저장 위치와 공유 권한을 다시 확인합니다. 원본 이미지, OCR 작업본, 최종 검수본을 이름으로 구분하고 보존 정책을 따릅니다.

완료 판정은 검색만으로 하지 않습니다

  • 문서의 핵심 문장 3개를 검색하고 실제 페이지로 이동하는지 확인했습니다.
  • 각 페이지의 첫 문장과 표 한 곳을 복사해 원본 이미지와 대조했습니다.
  • 화면 읽기 순서와 문서 언어가 올바른지 표본 확인했습니다.
  • 문서 속성의 보안 제한과 배포 권한을 다시 확인했습니다.

Word에서 만든 PDF의 글꼴 문제라면 PDF 글꼴 대체 원인을, 디자인 내보내기의 작은 글자 문제라면 선명한 텍스트 내보내기를 먼저 확인하십시오. 이미지 전용 PDF와 잘못 내보낸 전자 PDF는 해결 방법이 다릅니다.

OFFICIAL SOURCES

확인한 공식 자료

CORRECTION

화면이 달라졌나요?

운영체제와 프로그램 버전, 달라진 단계를 알려주시면 다시 확인합니다.

정정 요청 보내기