PDF에서 복사·검색이 안 될 때|텍스트 PDF와 스캔본 차이

PDF를 열었는데 글자를 길게 눌러도 선택되지 않거나, 검색창에 문서 안의 단어를 입력해도 결과가 나오지 않을 때가 있습니다.

이 경우 PDF 앱의 오류라고 단정하기보다 파일이 실제 텍스트로 만들어졌는지, 종이를 촬영한 이미지인지, 복사가 제한된 문서인지부터 구분해야 합니다.

먼저 답하면, 글자를 선택할 수 없고 검색도 되지 않는 PDF는 스캔 이미지로 만들어진 파일일 가능성이 큽니다.

스캔본은 화면에 글자가 보여도 컴퓨터가 이를 문자로 인식하지 못할 수 있습니다. 이때는 OCR 기능으로 글자를 인식시켜야 복사와 검색이 가능해집니다.

노트북의 PDF 문서 화면을 배경으로 PDF 복사 검색 안됨과 텍스트 PDF 스캔본 차이를 안내하는 이미지
텍스트 PDF와 스캔 PDF를 구분하고 OCR 적용 여부를 확인하는 방법


빠르게 구분하는 기준

글자 한 줄만 정확히 드래그할 수 있다면 텍스트 PDF일 가능성이 높습니다.

페이지 전체가 사진처럼 한꺼번에 선택되거나 아무것도 선택되지 않는다면 스캔 PDF일 가능성이 높습니다.

글자는 선택되는데 복사 메뉴만 작동하지 않는다면 문서 보안 설정도 확인해야 합니다.

텍스트 PDF와 스캔 PDF는 무엇이 다른가요?

텍스트 PDF는 한글, 영문, 숫자 등의 문자 정보가 파일 안에 들어 있습니다. 일반적으로 단어 검색, 글자 선택, 복사, 화면 읽기 기능을 사용할 수 있습니다.

스캔 PDF는 종이 문서를 스캐너나 카메라로 촬영해 페이지마다 이미지로 저장한 파일입니다. 사람 눈에는 글자로 보이지만 PDF 안에는 사진 정보만 들어 있을 수 있습니다.

확인 항목 텍스트 PDF 스캔 PDF
글자 선택 문장이나 단어 단위로 선택됨 선택되지 않거나 페이지 전체가 이미지로 잡힘
문서 검색 단어를 입력하면 해당 위치가 표시됨 검색 결과가 없거나 일부만 검색됨
복사·붙여넣기 대체로 가능함 OCR을 적용하기 전에는 어려움
확대했을 때 글자 선이 비교적 또렷하게 유지됨 사진처럼 흐려지거나 픽셀이 보일 수 있음
필요한 처리 PDF 앱과 보안 설정 확인 OCR 문자 인식 적용

다만 위 기준만으로 항상 정확히 나뉘는 것은 아닙니다. 일부 PDF는 텍스트 페이지와 스캔 페이지가 함께 들어 있는 혼합형 문서이기 때문입니다.

혼합형 문서는 앞부분은 검색되지만 첨부된 영수증이나 서명 페이지는 검색되지 않는 식으로 나타날 수 있습니다.

PDF 종류를 먼저 확인하는 가장 쉬운 방법

글자 한 줄을 선택해 봅니다

휴대폰에서는 문서의 글자 부분을 길게 누르고, PC에서는 마우스로 한 문장을 드래그해 봅니다.

단어별로 파란색 선택 영역이 생기면 문자 정보가 들어 있는 PDF입니다. 사각형 이미지 전체가 선택되거나 선택 표시가 나오지 않으면 스캔본일 가능성이 큽니다.

문서 안에서 흔한 단어를 검색합니다

PDF 앱의 돋보기 또는 찾기 메뉴를 열고 문서에 여러 번 등장하는 단어를 입력합니다.

화면에 분명히 보이는 단어인데도 검색 결과가 0개라면 이미지로 저장된 문서일 수 있습니다. 한두 페이지만 검색되지 않는다면 혼합형 PDF도 의심할 수 있습니다.

다른 PDF 앱으로 한 번 더 열어 봅니다

카카오톡이나 이메일 안의 간단한 미리보기 화면에서는 선택이나 검색 기능이 제한될 수 있습니다.

파일을 휴대폰에 저장한 뒤 기본 PDF 뷰어, 브라우저 또는 PDF 전용 앱으로 다시 열어 확인합니다.

PDF가 어디에 저장됐는지 모르겠다면 다운로드 파일 저장 위치 찾는 방법을 먼저 확인하면 됩니다.

휴대폰에서 PDF 복사·검색이 안 될 때 확인 순서

  1. PDF를 기기에 저장합니다.
    메신저나 이메일의 미리보기로만 열지 말고 다운로드 또는 파일 저장을 선택합니다.
  2. 파일 앱에서 저장된 PDF를 다시 엽니다.
    아이폰은 파일 앱, 갤럭시는 내 파일 앱에서 문서를 찾아 기본 뷰어나 설치된 PDF 앱으로 엽니다.
  3. 돋보기 메뉴로 문서 검색을 시험합니다.
    문서 첫 페이지에 보이는 제목이나 반복되는 단어를 입력합니다.
  4. 글자를 길게 눌러 선택해 봅니다.
    단어 선택 표시가 나오지 않으면 이미지 PDF일 가능성이 큽니다.
  5. 스캔본이라면 OCR 기능을 적용합니다.
    PDF 앱의 텍스트 인식, OCR, 스캔 텍스트 인식과 같은 메뉴를 사용합니다.
  6. 변환된 사본을 별도 이름으로 저장합니다.
    원본을 덮어쓰지 말고 파일명 뒤에 OCR 또는 텍스트인식 등을 붙여 저장하는 편이 안전합니다.
  7. 다시 검색하고 필요한 부분만 복사합니다.
    OCR 결과에는 오탈자가 생길 수 있으므로 금액, 날짜, 이름, 문서번호는 원본 화면과 대조합니다.

OCR이란?

OCR은 사진 속 글자 모양을 분석해 검색하고 복사할 수 있는 문자 정보로 바꾸는 기능입니다.

OCR을 적용해도 원래 이미지가 완전히 새 문서로 바뀌는 것은 아닙니다. 일반적으로 이미지 위나 아래에 검색 가능한 문자층이 추가됩니다.

새 종이 문서를 휴대폰으로 스캔해 PDF로 만들 예정이라면 처음부터 검색 가능한 형식으로 저장하는 편이 편합니다. Google Drive의 문서 스캔 기능은 스캔 문서를 검색 가능한 PDF로 저장할 수 있습니다.

PC에서 스캔 PDF를 검색 가능하게 만드는 방법

Chrome으로 먼저 열어 봅니다

PC에서 PDF를 Chrome으로 열었을 때 스캔 문서의 글자를 자동으로 인식해 선택과 검색을 지원하는 환경이 있습니다.

PDF 파일을 Chrome 창으로 끌어다 놓은 뒤 오른쪽 위 돋보기나 키보드의 Ctrl+F를 눌러 검색해 봅니다.

자동 인식이 되지 않거나 결과가 부정확하면 PDF 전용 OCR 프로그램을 사용해야 합니다.

Adobe Acrobat에서 OCR을 적용합니다

  1. Adobe Acrobat에서 스캔 PDF를 엽니다.
  2. 모든 도구에서 스캔 및 OCR을 선택합니다.
  3. 이 파일에서 또는 문서 안의 텍스트 인식 메뉴를 선택합니다.
  4. 인식할 페이지 범위와 문서 언어를 지정합니다.
  5. 텍스트 인식을 실행합니다.
  6. 처리가 끝나면 다른 이름으로 저장합니다.
  7. Ctrl+F로 검색하고 글자를 드래그해 복사되는지 확인합니다.

Adobe는 종이를 스캔해 만든 PDF에는 이미지 데이터만 들어 있을 수 있으며, OCR을 적용하면 선택하고 검색할 수 있는 텍스트층이 생성된다고 안내합니다.

여러 PDF를 한 파일로 묶어야 한다면 OCR을 먼저 끝낸 뒤 PDF 합치기 무료 방법을 따라 진행하는 편이 좋습니다.

합친 뒤 OCR을 적용할 수도 있지만 페이지가 많아지면 처리 시간이 길어지고, 어느 페이지에서 인식 오류가 났는지 찾기 어려울 수 있습니다.

OCR을 했는데도 복사되지 않을 때 확인할 것

  • OCR 언어가 한국어 또는 문서에 사용된 언어로 지정됐는지 확인합니다.
  • 사진이 기울어지거나 글자가 흐리고 작지 않은지 확인합니다.
  • 손글씨, 도장, 서명, 흐린 팩스 문서는 인식 정확도가 낮을 수 있습니다.
  • 일부 페이지만 이미지로 들어간 혼합형 PDF인지 확인합니다.
  • PDF 작성자가 내용 복사를 제한했는지 보안 속성을 확인합니다.
  • 메신저 미리보기가 아닌 저장된 원본 파일을 열었는지 확인합니다.
  • OCR 결과가 저장된 새 파일을 열었는지 확인합니다.

복사 제한이 설정된 PDF일 수 있습니다

검색은 되는데 복사 메뉴가 비활성화되거나 붙여넣기가 되지 않는다면 스캔본 문제가 아니라 문서 권한 문제일 수 있습니다.

PDF 작성자는 암호와 권한 설정을 이용해 텍스트와 이미지 복사, 편집, 인쇄를 제한할 수 있습니다. 이 제한은 문서 작성자나 관리 권한이 있는 사람이 해제해야 합니다.

비밀번호를 모르거나 문서 사용 권한이 없다면 제한을 우회하기보다 발급기관 또는 파일을 보낸 사람에게 복사 가능한 문서나 원본 자료를 요청해야 합니다.

OCR 인식 정확도가 낮을 수 있습니다

OCR은 화면에 보이는 글자를 추정해 변환하므로 항상 원문과 똑같지는 않습니다.

특히 0과 O, 1과 l, 5와 S처럼 모양이 비슷한 문자는 잘못 인식될 수 있습니다. 표, 세로쓰기, 작은 각주, 흐린 영수증도 오류가 생기기 쉽습니다.

제출용 PDF의 용량까지 줄여야 한다면 문자 인식과 내용 확인을 먼저 마친 다음 모바일에서 PDF 용량 줄이는 방법을 적용하세요.

압축을 먼저 강하게 하면 글자 선명도가 낮아져 OCR 인식률이 떨어질 수 있습니다.

내가 직접 정리한 판단 기준

실제로 가장 헷갈리는 상황

화면에 글자가 선명하게 보인다는 이유만으로 텍스트 PDF라고 생각하기 쉽습니다. 하지만 종이 문서를 고화질로 촬영한 스캔본도 화면에서는 일반 문서처럼 또렷하게 보일 수 있습니다.

판단할 때는 선명도보다 글자가 단어 단위로 선택되는지, 문서 검색이 되는지를 먼저 확인하는 것이 정확합니다.

안 될 때 확인할 것

복사와 검색이 모두 안 되면 스캔본 가능성을 먼저 보고, 검색은 되지만 복사만 안 되면 보안 제한을 확인합니다.

특정 페이지만 안 된다면 파일 전체 문제가 아니라 그 페이지만 이미지로 삽입된 혼합형 PDF일 수 있습니다.

확인 기준의 차이

PDF 검색은 파일 안에 저장된 문자 정보를 찾는 기능이고, 휴대폰 사진 앱의 글자 인식은 화면에 보이는 이미지를 분석하는 기능입니다.

사진 앱에서 글자가 선택되더라도 PDF 자체에 검색 가능한 텍스트가 저장됐다는 뜻은 아닙니다. 다른 사람에게 PDF를 보내 검색하게 하려면 OCR 결과가 포함된 PDF 파일로 다시 저장해야 합니다.

개인정보가 있는 문서는 주의하세요.

주민등록번호, 주소, 계좌번호, 카드번호, 진료정보, 인증번호, 계약번호가 들어 있는 PDF는 출처를 확인하기 어려운 온라인 변환 사이트에 올리지 않는 편이 안전합니다.

문서 내용이나 파일 전체를 댓글과 공개 문의에 첨부하지 마세요. 질문할 때도 이름과 문서번호 전체가 보이지 않도록 가린 뒤 필요한 부분만 설명해야 합니다.

공식 기능 확인

Adobe Acrobat의 OCR 사용법은 Adobe 스캔 PDF 텍스트 인식 안내에서 확인할 수 있습니다.

Chrome의 PDF 보기 및 OCR 지원 내용은 Google Chrome PDF 관리 안내에서 확인할 수 있습니다.

프로그램의 메뉴 이름, 무료 제공 범위와 화면 구성은 업데이트에 따라 달라질 수 있습니다. 중요한 문서는 사용 중인 앱의 공식 도움말과 고객센터 안내를 함께 확인하세요.

자주 묻는 질문

PDF 글자가 보이는데 왜 검색은 안 되나요?

글자가 실제 문자로 저장된 것이 아니라 페이지 전체가 사진으로 들어 있기 때문일 수 있습니다. 글자를 드래그해 선택해 보고 선택되지 않으면 OCR을 적용해 보세요.

OCR을 하면 원본 PDF 내용이 바뀌나요?

일반적으로 기존 스캔 이미지에 검색 가능한 문자 정보가 추가됩니다. 다만 앱에 따라 이미지 보정이나 압축이 함께 적용될 수 있으므로 원본은 남겨 두고 새 파일로 저장하는 것이 안전합니다.

검색은 되는데 복사만 안 되는 이유는 무엇인가요?

PDF 작성자가 텍스트와 이미지 복사를 제한했을 가능성이 있습니다. 문서 속성이나 보안 정보를 확인하고, 권한이 없다면 발급기관이나 작성자에게 복사 가능한 자료를 요청해야 합니다.

정리하면

복사와 검색이 모두 안 되는 PDF는 먼저 스캔본인지 확인합니다. 스캔본은 OCR을 적용해야 글자를 검색하거나 복사할 수 있습니다.

검색은 되지만 복사만 막힌다면 PDF 보안 권한을 확인해야 합니다. OCR을 적용한 뒤에는 금액, 날짜, 이름과 문서번호가 원본과 일치하는지도 반드시 대조하세요.

이 블로그의 인기 게시물

넷플릭스 결제일 확인 방법 - 구독료·결제수단·해지 전 확인할 것

신용카드 결제 취소 확인 방법|승인취소·매입취소·환불일 차이

휴대폰 초기화 전 확인할 것|사진·카카오톡·인증서·계정 백업 순서