Epix / 업무자동화

PDF에서 글자 검색·복사가 안 될 때: 스캔 여부 확인과 OCR

글자는 보이는데 PDF에서 찾기와 복사가 안 된다면 파일이 페이지 이미지만 담았는지 먼저 확인하세요. 이미지 스캔이면 OCR로 검색용 텍스트를 만들고, 글자를 선택할 수 있는데 복사 결과가 깨지면 OCR보다 텍스트 인코딩·글꼴 매핑을 따로 진단해야 합니다. 원본을 보존한 사본에서 작업하세요.

PDF에 글자가 보이지만 검색·복사가 되지 않는다면 먼저 글자 한 단어를 드래그해 선택하고 Ctrl+F(Mac은 Command+F)로 같은 단어를 찾아 보세요. 선택도 검색도 안 되고 페이지가 사진처럼 보이면 이미지 스캔일 가능성이 높아 OCR(광학 문자 인식)이 필요합니다. 반대로 글자를 선택할 수 있는데 붙여 넣은 문장이 깨지거나 검색이 빗나가면 스캔이 아니라 글꼴의 문자 매핑 문제일 수 있습니다. 원본은 보관하고 복사본에 OCR을 실행한 뒤 검색·복사·숫자를 직접 대조하세요.

PDF 문서 작업 · Google Drive와 Adobe Acrobat 공식 도움말 확인: 2026년 10월 5일

PDF에서 글자를 선택하고 검색해 스캔 이미지, 텍스트 매핑, 보안 제한을 구분한 다음 OCR 결과를 검수하는 흐름
OCR 전에 원인을 가르면 멀쩡한 텍스트 PDF를 불필요하게 다시 변환하는 일을 줄일 수 있습니다.

주민등록번호, 급여, 계약, 진료 기록, 고객 정보가 든 문서는 승인되지 않은 클라우드·온라인 OCR 사이트에 업로드하지 마세요. 회사·학교 문서는 조직이 허용한 도구와 계정으로 처리합니다. 원본을 덮어쓰지 말고 접근 권한이 있는 복사본만 사용하세요.

먼저 화면 증상으로 스캔 여부를 나눕니다

PDF에서 글자가 보인다고 해서 실제 텍스트가 들어 있다고 보장되지는 않습니다. 종이를 스캔한 PDF는 각 페이지가 사진 한 장처럼 들어 있을 수 있습니다. 반대로 텍스트가 이미 있어도 문서 글꼴과 문자 코드 연결이 깨져 검색·복사가 실패할 수 있습니다. 두 경우의 해결 방법은 다릅니다.

해 본 동작화면에서 보이는 결과먼저 할 일
글자를 마우스로 드래그문장 대신 페이지 전체가 선택되거나 아무것도 선택되지 않음스캔 이미지인지 확인하고 복사본에서 OCR 검토
Ctrl/Cmd+F로 눈에 보이는 단어 찾기해당 단어가 페이지에 보이는데 결과 0건다른 페이지와 다른 PDF 뷰어에서도 같은지 비교
글자를 선택해 복사붙여 넣으면 공백·기호·다른 글자로 바뀜텍스트 매핑·글꼴 인코딩 문제 가능성; 원본 문서나 정상 내보내기본 확인
일부 페이지에서만 검색다른 페이지는 선택·검색이 됨페이지별로 텍스트가 섞인 PDF; 필요한 페이지만 OCR
선택·복사 메뉴가 비활성화보안·권한 안내가 표시되거나 편집/복사 제한파일 소유자에게 허용된 복사본 또는 텍스트 제공본 요청
한 PDF 앱에서만 선택 불가브라우저 미리보기와 데스크톱 앱 결과가 다름PDF 문서가 아니라 뷰어의 선택·검색 기능 문제인지 확인

페이지를 지우거나 순서를 바꾸는 작업은 텍스트 검색 문제와 별개입니다. PDF를 나누거나 합친 뒤 OCR 텍스트가 남았는지까지 확인하려면 PDF 페이지 순서 변경·삭제·추출 안내도 참고하세요.

OCR을 누르기 전에 원본 PDF에서 두 가지를 시험합니다

  1. 가능하면 PDF를 내려받아 Adobe Acrobat Reader, 브라우저 PDF 뷰어 등 다른 앱에서도 열어 봅니다. 웹 미리보기만 선택이 막힐 수 있어 다른 뷰어 결과와 비교해야 합니다.
  2. 문서 가운데 한 페이지에서 짧고 눈에 잘 띄는 단어를 드래그합니다. 단어 일부가 아니라 페이지 전체가 잡히면 이미지일 가능성이 높습니다.
  3. Ctrl+F 또는 Mac의 Command+F로 그 단어를 직접 입력합니다. OCR 전에는 화면의 공백·줄바꿈과 완전히 똑같이 입력하지 말고 문장 중간의 고유한 낱말을 시험합니다.
  4. 앞·중간·끝 페이지에서 한 번씩 반복합니다. 앞쪽만 검색되고 뒤쪽은 안 된다면 PDF 전체가 아닌 특정 페이지만 이미지일 수 있습니다.
  5. 글자가 선택되면 메모장이나 텍스트 편집기에 한 줄만 붙여 넣어 봅니다. 선택은 되는데 한글이 깨지면 OCR 버튼을 반복하기 전에 원본 파일이나 만든 사람의 정상 내보내기 PDF를 요청하세요.

이 테스트는 OCR이 필요한 파일인지 진단하는 과정입니다. 복사 제한을 해제하거나 암호·소유자 권한을 우회하는 방법을 설명하는 절차가 아닙니다. 필요한 권한이 없다면 문서 소유자나 관리자가 승인한 검색 가능한 사본을 요청하세요.

목표에 맞춰 Google Drive 또는 Acrobat을 고릅니다

필요한 결과먼저 볼 방법알아둘 차이
문서 내용을 빠르게 추출·검색Google Drive에서 Google Docs로 열기안내된 최적 입력은 2MB 이하. 결과는 Google Docs이며 원본 PDF를 그대로 유지하는 OCR 저장 방식과 다름
원래 PDF 모양을 유지하며 검색 가능한 PDF 생성Acrobat의 Scan & OCR복사본에서 페이지 범위·인식 언어를 선택하고 처리 후 직접 검수
원래 편집 문서 파일이 있음Word·한글·Docs 원본을 다시 PDF로 내보내기이미지 글자를 추측하는 OCR보다 문자 정확도를 보존하기 쉬움
문서가 열리지 않거나 복사 기능이 막힘소유자에게 접근 권한·검색 가능한 사본 요청OCR은 잠금 해제나 접근 권한 획득 방법이 아님

Google Drive는 이미지 PDF에서 Google Docs 문서를 만드는 간단한 추출 경로입니다. 여러 페이지의 줄맞춤·표·각주 모양을 그대로 보존할 필요가 있다면 Acrobat에서 검색 가능한 텍스트 레이어를 만드는 방식을 검토하세요. 사용 가능한 기능과 메뉴 이름은 앱 버전·계정·라이선스에 따라 달라질 수 있습니다.

Google Drive에서 작은 PDF의 글자를 추출합니다

Google 도움말은 여러 페이지 PDF도 Google Docs로 변환할 수 있다고 안내합니다. 다만 최적 결과를 위한 파일 크기는 2MB 이하이고 텍스트 높이는 10픽셀 이상입니다. 흐릿하거나 기울어진 사진은 OCR 오류가 늘 수 있으므로 파일을 다시 스캔할 수 있다면 방향과 대비부터 확인하세요.

  1. 원본 PDF를 별도 폴더에 보관하고 작업용 사본을 만듭니다. 문서가 회사·고객·개인 정보를 포함하면 개인 Google Drive에 올리지 말고 조직의 보안 정책을 먼저 확인합니다.
  2. Google Drive 웹에서 사본을 선택하고 마우스 오른쪽 버튼을 누릅니다.
  3. 연결 앱 > Google Docs를 선택합니다. 변환 메뉴가 표시되지 않으면 업로드한 파일 형식·계정 정책·조직 관리자의 Drive 설정을 확인합니다.
  4. 새 Google 문서에서 문장 검색과 복사를 시험합니다. PDF가 여러 페이지면 중간·마지막 쪽의 텍스트도 빠지지 않았는지 확인합니다.
  5. 검색 가능한 PDF가 필요하다면 Google Docs에서 내려받기 전에 표·목록·페이지 경계·각주·열 배치가 원본과 달라졌는지 확인합니다. Google은 목록·표·열·각주·미주가 유지되지 않을 수 있다고 안내합니다.
  6. 제출 형식이 PDF라면 확인된 Google 문서를 PDF로 내보내 새 파일로 저장한 다음 페이지 수, 검색, 줄바꿈을 다시 점검합니다. 변환 문서는 원본과 별도 버전으로 관리합니다.

Drive 변환이 파일을 2MB보다 크다고 거부하거나 결과가 흐트러질 때: 먼저 페이지를 여러 파일로 나누는 것이 제출·개인정보 규칙에 맞는지 확인하세요. 원본 스캔을 더 선명하게 다시 만들 수 있거나 Acrobat에서 특정 페이지 범위를 처리할 수 있다면 그 방법을 고려합니다. 압축으로 품질이나 양식이 바뀔 수 있으므로 PDF 압축 뒤 화질·서명 검수 순서와 원본 보존 원칙을 확인하세요.

Acrobat에서 검색 가능한 PDF 텍스트 레이어를 만듭니다

  1. 파일 탐색기나 Finder에서 원본을 복제합니다. 사본을 열어 모든 도구에서 스캔 및 OCR(Scan & OCR)을 선택합니다.
  2. 이 파일에서(In this file)를 누릅니다. 현재 앱에서 항목이 보이지 않으면 제품 종류·버전·계정 기능을 확인하고 다른 권한 있는 경로를 선택합니다.
  3. 전체 페이지가 아니라 문제가 있는 범위를 지정할 수 있습니다. 일부 페이지만 이미지인 혼합 PDF라면 검색되지 않는 해당 쪽만 선택합니다.
  4. 문서의 주 언어를 선택합니다. 한글이 들어간 문서라면 한국어 인식을 지정할 수 있는지 확인하세요. 여러 언어가 섞인 문서나 표 안의 짧은 코드는 결과를 따로 주의해 검수합니다.
  5. 텍스트 인식(Recognize Text)을 실행합니다. Acrobat은 이미지가 있는 페이지 위에 선택·검색 가능한 텍스트 레이어를 만듭니다.
  6. 저장할 때 원본 이름에 덮어쓰지 말고 파일명에 -ocr 또는 날짜를 붙인 새 사본으로 저장합니다.
  7. 저장본을 닫았다 다시 열어 Ctrl/Cmd+F 검색, 문장 선택·복사, 원래 페이지 모양을 점검합니다. 일부 메뉴와 결과 옵션은 현재 제품 버전·구독에 따라 다를 수 있습니다.

OCR은 원래 인쇄 글자의 모양을 보고 텍스트를 추정합니다. Acrobat 공식 도움말도 인식 후 정확하고 완전한지 검토하고 필요한 경우 수정하거나 설정을 바꿔 다시 인식하도록 안내합니다. 작은 한글 글꼴, 기울어진 원본, 낮은 대비, 도장·필기·복잡한 표에서는 특히 원문 대조가 필요합니다.

검색·복사·페이지 모양을 각각 검수합니다

검수 항목실행 방법통과 기준
검색Ctrl/Cmd+F로 페이지 앞·중간·끝의 서로 다른 단어 찾기검색 결과가 해당 페이지와 문맥을 가리킴
복사본문 한 문장을 복사해 일반 텍스트 편집기에 붙여 넣기한글·띄어쓰기·괄호·기호가 눈으로 읽히는 형태
중요 숫자금액·날짜·계좌/주문 식별값은 원본 이미지와 문자 단위로 비교숫자 0/O, 1/I, 쉼표·소수점, 하이픈을 각각 확인
페이지 표시OCR 전·후 PDF의 첫·중간·끝 페이지 비교원본 이미지, 페이지 수, 서명·도장 위치가 기대대로 유지됨
후속 제출새 이름의 파일을 열어 첨부·업로드 전에 확인원본/작업본이 구분되고 비밀번호·제출 형식 요구 충족

금액·기한·계약 조항처럼 한 글자 차이가 결과를 바꾸는 자료는 OCR 텍스트만 보고 확정하지 마세요. 검색 가능한 결과와 사람이 눈으로 확인한 원문 이미지를 함께 대조합니다. 양식 입력이나 서명 동작이 필요한 파일은 텍스트 OCR과 별도이므로 PDF 입력 칸·전자 서명 문제 해결에서 일반 PDF와 대화형 양식을 나눠 보세요.

인식 결과가 없거나 한글이 틀릴 때

  • 텍스트가 흐리고 기울어짐: 가능하면 종이를 반듯하게 놓고 조명·초점을 개선해 다시 스캔합니다. 이미지의 글자 자체가 뭉개졌다면 OCR이 원문을 복구해 주지 못합니다.
  • 한글이 빠지거나 비슷한 숫자로 바뀜: OCR 언어가 주 문서와 맞는지 확인하고, 먼저 사본·필요한 페이지 범위에서 다시 시도합니다. 날짜·금액·코드는 원본과 직접 대조합니다.
  • 표나 다단 문서 순서가 어긋남: Google Docs 변환은 표·목록·열·각주 구조를 유지하지 못할 수 있습니다. 텍스트 검색만 필요하면 문서 결과의 텍스트를 검수하고, 원래 배치가 중요하면 PDF를 보존한 Acrobat 경로를 우선합니다.
  • 일부 페이지만 검색되지 않음: PDF는 원본 텍스트와 이미지 스캔이 섞일 수 있습니다. 전체 문서를 다시 만드는 대신 검색이 안 되는 페이지만 OCR하고 문서 전체를 다시 시험합니다.
  • 선택은 되지만 붙여 넣은 글자가 계속 깨짐: PDF 안의 글꼴 문자 코드가 Unicode 글자와 올바르게 연결되지 않았을 수 있습니다. 원본 문서에서 PDF를 다시 내보내거나 문서 소유자에게 정상 검색본을 요청하세요.
  • OCR·복사 메뉴가 막힘: 복사·편집 제한이나 권한이 있는지 확인하고 소유자에게 허용된 복사본을 요청합니다. 제한을 해제하거나 암호를 우회하는 방법은 해결 단계로 삼지 않습니다.

검색 가능한 PDF와 접근성 PDF는 다릅니다

OCR로 화면에 보이는 글자를 검색할 수 있게 만들면 텍스트 읽기·복사에 도움이 됩니다. 그러나 검색이 된다고 문서 구조가 모두 접근 가능해지는 것은 아닙니다. 화면 낭독기가 문서 순서대로 읽도록 하는 태그·제목·표 구조·이미지 대체 텍스트는 별도 확인이 필요합니다. Adobe도 PDF 접근성 안내에서 검색 가능한 텍스트와 문서 구조 태그·읽기 순서를 각각 설명합니다.

대외 배포물에 접근성 요구가 있으면 OCR만 완료한 상태를 최종 검수로 간주하지 말고, 만든 사람이나 조직의 접근성 점검 절차를 따르세요. PDF 압축도 검색 가능·양식·서명 상태에 영향을 줄 수 있어 압축 후 제출본 검수를 별도로 확인하는 것이 안전합니다.

자주 묻는 질문

글자가 화면에 보이는데 PDF 검색만 안 되는 이유는 무엇인가요?

종이 스캔본처럼 화면 전체가 이미지로 들어 있고 검색용 텍스트가 없을 수 있습니다. 텍스트를 선택할 수 있는데도 검색이 안 되면 뷰어·글꼴 문자 매핑·문서 내 텍스트 인코딩 문제일 수 있으므로 다른 뷰어와 원본 파일도 확인하세요.

Google Drive OCR로 원래 PDF에 검색 기능이 추가되나요?

Google 도움말의 경로는 PDF나 사진을 Google Docs로 여는 변환입니다. 원래 PDF 파일을 보존한 채 그 안에 텍스트 레이어를 추가하는 Acrobat 경로와는 다릅니다. 원본과 Google 문서를 별도 파일로 두고, 새 PDF가 필요하면 변환 결과를 검수한 후 내보내세요.

Google Drive에서 PDF가 변환되지 않아요.

공식 도움말의 최적 입력 조건인 2MB 이하인지 확인하세요. 글자 높이·방향·선명도·명암도 결과에 영향을 줍니다. 회사 계정의 조직 정책이 연결 앱 사용을 제한할 수도 있습니다.

OCR한 PDF를 검색할 수 있으면 화면 낭독기도 올바르게 읽나요?

그렇다고 단정할 수 없습니다. OCR 텍스트 검색 가능 여부와 PDF 태그·읽기 순서·표 구조 검수는 서로 다른 작업입니다. 접근성 제출 요구가 있다면 구조와 읽기 순서를 별도로 점검하세요.

필기·도장·표의 값도 OCR을 믿어도 되나요?

아니요. OCR은 문자를 추정하므로 필기·저해상도·선·도장 겹침·복잡한 표에서 틀릴 수 있습니다. 중요한 날짜·금액·번호는 원본 이미지와 한 글자씩 맞춰 확인하세요.

잠긴 PDF에서 복사를 허용하도록 바꿀 수 있나요?

문서 소유자나 관리자가 설정한 권한을 허가 없이 변경하지 마세요. 필요한 텍스트나 읽기 가능한 사본이 있다면 소유자에게 권한을 요청하세요.

PDF에서 개인정보를 배포 전에 실제로 제거해야 한다면 검색 텍스트·스캔 이미지 교정과 숨은 정보 검수 가이드를 이어서 확인하세요.

공식 도움말

앱 메뉴와 계정 기능은 제품 버전·조직 정책·라이선스에 따라 달라질 수 있습니다. Google Drive 및 Adobe 도움말은 2026년 10월 5일 확인했습니다. Search Console 쿼리·검색량은 확인하지 않았습니다.