PDF를 OCR로 변환해 텍스트 추출

PDF를 검색하고 편집하며 바로 활용할 수 있는 문서로 만드세요.

최대 100MB까지

파일을 업로드하면 당사의 이용 약관 에 동의하고 당사의 개인정보 보호정책

PDF 파일에서 OCR로 텍스트를 추출하는 방법

  • download PDF첫 번째 파일을 무료로 다운로드하세요. PDF Guru를 계속 사용하려면 구독 플랜 중 하나를 선택하세요.
  • upload pdf file + 버튼을 클릭하거나 파일을 업로드 영역으로 끌어다 놓으세요.
  • add pdf update여백, 페이지 크기, 방향을 설정한 다음 형식을 선택하세요.
  • download PDF파일 처리가 끝나면 새 문서를 기기에 다운로드하세요.
how to ocr pdf

업계 리더의 신뢰와 인증

Norton by SymantecSecure SSL EncryptionGoogle Safe BrowsingPDF Association Member

PDF OCR 변환 도구로 PDF Guru를 선택해야 하는 이유

  • benefit 1

    다양한 형식 지원

    스캔한 PDF, PNG, JPG, JPEG 파일을 업로드하면 필요한 편집 가능 문서로 변환됩니다.
  • benefit 2

    90개 이상의 언어

    PDF Guru OCR은 키릴 문자, 아랍 문자, CJK 문자와 그 밖의 비라틴 문자를 사용하는 언어를 포함해 90개 이상의 언어로 된 텍스트를 읽습니다.
  • benefit 3

    스캔, 사진, 필기 인식

    저화질 자료도 포함해 스캔 문서, 휴대폰 사진, 스크린샷, 필기에서 검색 가능한 PDF를 만들 수 있습니다.
  • benefit 3

    PDF 도구 연동

    PDF-OCR 텍스트 변환기는 다른 PDF Guru 도구와 원활하게 연동되므로 한곳에서 파일을 손쉽게 병합하고 서명하고 압축할 수 있습니다.
  • benefit 1

    복잡한 레이아웃도 정확하게 처리

    온라인 OCR 도구는 단순한 일반 텍스트뿐 아니라 표, 수학 공식, 다단 구성, 이미지도 처리합니다.
  • benefit 2

    자체 개발 OCR 기술

    PDF Guru 기술팀이 자체 개발한 OCR은 모든 유형의 콘텐츠를 인식하고 PDF를 읽을 수 있는 문서로 변환하도록 최적화했습니다.

PDF에 OCR을 적용해 문서 활용도를 높이세요

PDF OCR 변환기는 스캔 문서, 사진, 필기 메모를 편집하고 검색할 수 있는 텍스트로 바꿉니다. 계약서, 영수증, 양식의 핵심 정보를 손쉽게 확인하고 작업에 맞는 여러 형식으로 업로드할 수 있습니다. 새 옵션으로 파일이 완성되기 전에 여백, 페이지 크기, 방향을 설정할 수 있습니다. 다른 PDF Guru 기능과 완전히 연동되어 한곳에서 문서를 매끄럽게 편집하고 병합하고 서명할 수 있습니다.

용도에 맞게 선택하는 OCR 출력 형식

다음 세 가지 형식 중 하나로 파일을 받을 수 있습니다.

  • Word 문서

    더 이상 내용을 다시 입력하지 마세요. 계약서, 양식, 오래된 파일을 몇 분 안에 편집하고 재사용할 수 있는 Word 문서로 바꿀 수 있습니다.
  • 검색 가능한 PDF

    파일의 원래 모양은 그대로 유지하면서 모든 단어를 검색할 수 있습니다. 몇 초 만에 조항을 찾고 숫자를 강조 표시하거나 PDF에서 텍스트를 복사하세요.
  • 일반 텍스트

    문자만 즉시 추출합니다. 스크린샷이나 사진의 텍스트를 바로 복사해 이메일, 양식, 메모에 붙여 넣으세요.

PDF Guru OCR 도구의 기반 기술

PDF Guru OCR 스캐너는 기본적인 텍스트 추출을 넘어섭니다. 파일을 읽어 편집, 검색, 복사, 변환, 번역하거나 다른 PDF Guru 도구로 전달할 수 있는 구조화된 결과물을 만듭니다.

사용자들의 의견

훌륭함
44,076리뷰

OCR로 스캔 문서의 텍스트를 추출하세요

자주 묻는 질문

  • OCR이란 무엇인가요?

    OCR은 광학 문자 인식(Optical Character Recognition)의 약자입니다. 선택하거나 검색할 수 없는 텍스트가 담긴 스캔 문서 또는 이미지를 완전히 편집하고 검색할 수 있는 문서로 바꾸는 기술입니다.

    간단히 말해 PDF 글자 추출 기능으로 PDF 또는 이미지 파일의 텍스트를 꺼내 다음과 같이 온전히 활용할 수 있습니다.

    1. 검색;

    2. 편집;

    3. 복사하여 붙여 넣기.

    작동 방식이 궁금한가요? 검색 가능한 PDF 변환기를 사용해 보세요. 파일을 업로드하고 출력 형식을 선택하면 나머지는 PDF Guru가 처리합니다.

  • OCR은 어떻게 작동하나요?

    광학 문자 인식(OCR)은 인쇄되거나 손으로 쓴 텍스트 이미지를 기계가 읽을 수 있는 디지털 텍스트로 변환합니다. 이것이 일반적인 원리입니다.

    좀 더 자세히 살펴보면 PDF 문자 인식은 문서를 스캔하는 것부터 시작합니다. 이어서 이미지를 선명하게 보정하고 흐릿한 부분과 배경 얼룩을 제거해 텍스트를 또렷하게 만듭니다. 핵심 단계에서는 각 문자와 숫자의 모양을 알려진 패턴과 대조해 인식합니다. 마지막으로 텍스트를 자유롭게 수정할 수 있는 파일로 변환하므로 PDF를 편집 가능한 텍스트로 바꾸는 데 몇 초면 충분합니다.

    다음 질문에서는 PDF에 OCR을 적용해 검색 가능한 문서로 만드는 단계를 안내합니다.

  • 스캔한 PDF를 검색 가능하게 만드는 방법은 무엇인가요?

    스캔한 PDF를 검색 가능하게 만들려면 PDF Guru가 오랜 시간과 노력을 들여 개발한 광학 문자 인식 기능을 실행해야 합니다.

    검색 가능한 PDF 변환 절차는 다음과 같습니다.

    1. 페이지 맨 위로 이동합니다.
    2. PDF, PNG, JPG, JPEG 파일을 창에 끌어다 놓습니다.
    3. 여백, 페이지 크기, 방향을 설정합니다.
    4. 출력 형식으로 ‘검색 가능한 PDF’를 선택하고 파일 이름을 지정합니다.
    5. ‘다운로드’를 누릅니다.
    6. PDF 텍스트가 검색 가능한 상태로 바뀔 때까지 몇 초간 기다립니다.

    안정적인 인터넷 연결만 있으면 Mac뿐 아니라 휴대폰이나 태블릿에서도 PDF 변환기(OCR)를 사용할 수 있습니다. 별도의 OCR 사이트 없이 브라우저에서 모두 실행되므로 소프트웨어를 설치할 필요가 없습니다.

  • OCR 텍스트 인식은 문서 서식에 영향을 주나요?

    네. OCR은 원본 문서의 서식을 바꾸는 경우가 많지만, 변화의 정도는 저장 형식에 따라 다릅니다. 검색 가능한 PDF는 원래 레이아웃과 디자인을 유지하면서 텍스트 레이어를 추가하므로 외관을 바꾸지 않고 편집하고 읽을 수 있는 파일이 됩니다. Word는 편집 자유도가 가장 높지만 OCR로 PDF를 Word로 변환하면 페이지를 처음부터 재구성하므로 레이아웃이 조금 달라질 수 있습니다. 서식이 중요하지 않다면 일반 텍스트(TXT)를 선택해 다른 곳에 붙여 넣기 쉬운 원문 텍스트만 추출할 수 있습니다.

    PDF 글자 인식 정확도는 내부 테스트로 검증했습니다. 까다로운 파일에서 불분명하게 남은 부분도 편집기에서 쉽게 수정할 수 있습니다.

  • PDF 문서용 OCR은 모든 언어에서 작동하나요?

    아니요. OCR이 모든 언어에서 똑같이 잘 작동하는 것은 아닙니다. 최신 도구는 수십 개 언어를 지원하지만 엔진이 각 문자 체계를 인식하도록 설정되어 있어야 합니다. PDF Guru OCR PDF 편집기는 90개 이상의 언어를 지원하므로 다양한 언어 환경에서 활용할 수 있습니다.

    법률 문서, 학술 논문, 개인 메모 등 어떤 콘텐츠를 다루든 OCR을 사용하면 PDF를 읽고 관리하기 쉬운 상태로 만들 수 있습니다.

  • 스캔한 PDF에서 텍스트를 추출할 수 있나요?

    네. OCR 텍스트 추출 기능을 사용하면 스캔한 PDF를 Word 파일이나 일반 텍스트로 몇 초 만에 변환할 수 있습니다. 처리된 모든 파일은 나중에 다시 사용할 수 있도록 PDF Guru 계정에 안전하게 저장됩니다.

  • 스캔한 PDF를 편집 가능한 Word로 변환하려면 어떻게 하나요?

    스캔한 PDF를 편집 가능한 Word 문서로 바꾸려면 PDF Guru 광학 문자 인식 소프트웨어를 사용하세요. 파일을 업로드하면 각 페이지의 텍스트를 읽고 편집 가능한 Word 문서로 재구성합니다.

    이 과정만으로 스캔한 PDF를 실제로 작업할 수 있는 Word 문서로 바꿀 수 있습니다. 내용을 다시 타이핑하지 않고 수정하고 서식을 새로 지정할 수 있습니다.

    온라인 도구는 인쇄된 텍스트만 읽는 데 그치지 않습니다. OCR 문자 인식 엔진은 스캔본에 손으로 작성한 내용이 있어도 필기 메모를 같은 방식으로 텍스트로 변환합니다.

  • PDF 이미지를 Word 텍스트로 변환하려면 어떻게 하나요?

    PDF 문자 추출 작업에는 광학 문자 인식(OCR) 도구를 사용할 수 있습니다. 이 도구는 이미지에서 문자를 직접 읽으며, 이미지 기반 PDF, JPG, PNG 파일을 업로드하면 편집 가능한 Word 파일로 반환합니다.

  • PDF에 이미 OCR이 적용되었는지 어떻게 알 수 있나요?

    PDF에 OCR 또는 활성 텍스트 레이어가 있는지 확인하려면 PDF 뷰어에서 파일을 열고 한 줄의 단어 위로 커서를 드래그하세요. 텍스트를 강조 표시하고 복사할 수 있다면 이미 OCR이 적용된 것입니다. 아무것도 강조되지 않고 페이지가 이미지처럼 작동한다면 OCR이 적용되지 않은 상태입니다. 문서에 있는 단어를 검색하는 방법도 있습니다. PDF 검색 결과에 해당 단어가 나타나면 텍스트 레이어가 있는 것입니다.

  • PDF에서 OCR이 작동하지 않는 이유는 무엇인가요?

    PDF OCR 인식 결과가 좋지 않은 원인은 낮은 이미지 해상도, 배경 얼룩, 도구가 또렷하게 읽기 어려운 흐릿하고 불분명한 필기인 경우가 많습니다. 지나치게 흐릿한 스캔본이나 익숙하지 않은 언어 또는 문자 체계도 인식을 방해할 수 있습니다. PDF Guru 도구는 읽기 전에 이미지를 선명하게 보정하고 배경 노이즈를 제거하며, 불분명하게 남은 부분은 편집기에서 쉽게 수정할 수 있습니다.

  • Adobe Acrobat 없이 PDF에 OCR을 적용하려면 어떻게 하나요?

    Adobe Acrobat 없이도 PDF 텍스트 추출 사이트를 이용하면 브라우저에서 바로 OCR을 적용할 수 있으며, 다운로드하거나 설치할 프로그램은 없습니다. 파일을 업로드하고 여백, 페이지 크기, 방향을 설정한 다음 Word, 검색 가능한 PDF, 일반 텍스트 중 출력 형식을 선택하세요. 몇 초간 기다린 뒤 결과를 다운로드하면 됩니다.

  • 기밀 스캔 문서를 PDF Guru에 업로드해도 안전한가요?

    PDF Guru는 SSL 인증서와 고급 암호화 같은 강력한 보호 기술로 문서를 안전하게 지킵니다. 또한 Google Safe Browsing은 바이러스와 피싱 같은 온라인 위협으로부터 사용자를 보호합니다.

  • 일반 PDF와 OCR이 적용된 PDF의 차이는 무엇인가요?

    일반 PDF는 텍스트나 문서를 전자 이미지로 저장한 것이므로 단어가 보여도 선택하거나 검색하거나 복사할 수 없습니다. OCR이 적용된 PDF에는 PDF 텍스트 인식 기능으로 만든 텍스트 레이어가 추가되어 이미지 속 문자를 실제로 활용할 수 있는 텍스트로 바꿉니다.

  • PDF에서 텍스트를 선택하거나 검색할 수 없는 이유는 무엇인가요?

    대개 PDF가 디지털 문서가 아니라 하나의 평면적인 스캔 이미지이기 때문에 텍스트를 선택하거나 검색할 수 없습니다. 기기는 실제 단어가 아닌 그림으로 인식하므로 텍스트가 강조되지 않고 검색 결과도 나오지 않습니다. PDF로 저장한 사진과 스크린샷도 마찬가지입니다. OCR 도구를 실행하면 문자를 읽고 텍스트 레이어를 추가해 PDF 텍스트 추출 및 선택, 검색, 복사가 가능해집니다.

  • 어떻게 취소하나요?

    계정 설정에서 또는 고객 지원팀에 문의하여 언제든지 취소할 수 있습니다. 현재 결제 기간이 끝날 때까지 액세스가 유지됩니다.

PDF 문서와 함께 작업할 도구 선택