실용적인 작업 흐름

OCR로 스캔 문서를 검색 가능하게 만들기

스캔의 글자를 로컬에서 인식하고 일반 텍스트와 검색 가능한 PDF를 내려받아 나중에 찾아볼 수 있게 합니다.

시작 설정

영어, 스페인어, 중국어 간체 인식 중에서 선택합니다. 입력은 20 MiB, PDF는 10페이지, 원본 이미지는 1,200만 픽셀까지 지원합니다. 기존 텍스트가 있는 페이지는 기본적으로 건너뜁니다.

처리 단계

  1. 스캔이나 가상의 텍스트 샘플을 불러옵니다. 인터페이스 언어가 아니라 문서에 인쇄된 언어를 선택하세요.
  2. OCR을 시작하면 선택한 모델을 필요할 때 내려받습니다. 스캔 위에 텍스트 머리글만 있는 페이지라면 기존 텍스트 페이지 건너뛰기를 끄고 다시 시도하세요.
  3. 인식 결과를 검토한 다음 텍스트 파일과 검색 가능한 PDF를 다운로드합니다. 별도의 PDF 리더에서 알고 있는 문구를 검색해 보세요.

결과 확인

이름, 숫자, 중요한 문장을 이미지와 대조하세요. 신뢰도 추정값은 정확성의 증거가 아닙니다.

제한과 손실

OCR 페이지는 보이지 않는 텍스트가 포함된 래스터 이미지가 됩니다. 원본의 편집 가능한 레이아웃, 양식, 링크는 보존되지 않습니다. 인증된 PDF/A 보관 형식 변환이 아닙니다.

로컬 처리

파일과 결과는 이 브라우저 안에만 보관되며 원본을 덮어쓰지 않습니다. 샘플에는 가상의 데이터가 들어 있습니다. 지우거나 페이지를 나가기 전에 결과를 다운로드하세요. OCR은 인식 모델을 내려받으며 문서를 업로드하지 않습니다.

검토일