PDF에서 텍스트 추출

PDF의 기존 텍스트를 추출하거나 영어, 스페인어, 중국어 간체 인쇄물 스캔과 이미지를 로컬 OCR로 인식하세요.

이 도구가 유용할 때

디지털 생성 보고서, 기사, 청구서 및 메모에서 읽을 수 있는 텍스트를 복사하여 검색하거나 편집

로컬 처리 작동 방식

기본 추출 모드: 브라우저가 각 페이지의 텍스트 항목을 읽고, 대략적인 읽기 순서로 결합하고, 페이지를 구분하며, UTF-8 일반 텍스트 다운로드 생성 문서는 브라우저 메모리에만 유지됩니다. OCR 코드와 선택한 언어 모델은 이 사이트에서 내려받으며 파일 업로드가 아닙니다. 페이지를 떠나거나 지우면 문서와 결과를 버립니다. 이 페이지는 OCR 없이 복사합니다. 스캔 페이지의 머리글만 텍스트이고 나머지 부분을 인식해야 하면 끄세요.

사용 방법

  1. 소스 준비: 디지털 생성 보고서, 기사, 청구서 및 메모에서 읽을 수 있는 텍스트를 복사하여 검색하거나 편집
  2. 로컬에서 처리: 기본 추출 모드: 브라우저가 각 페이지의 텍스트 항목을 읽고, 대략적인 읽기 순서로 결합하고, 페이지를 구분하며, UTF-8 일반 텍스트 다운로드 생성 문서는 브라우저 메모리에만 유지됩니다. OCR 코드와 선택한 언어 모델은 이 사이트에서 내려받으며 파일 업로드가 아닙니다. 페이지를 떠나거나 지우면 문서와 결과를 버립니다. 이 페이지는 OCR 없이 복사합니다. 스캔 페이지의 머리글만 텍스트이고 나머지 부분을 인식해야 하면 끄세요.
  3. 다운로드 및 확인: 사용 전에 인식한 텍스트와 PDF를 원본과 비교하세요. 신뢰도는 추정치이며 정확도를 보장하지 않습니다.

중요한 제한 사항

인쇄 문자만 대상으로 하며 오인식할 수 있습니다. 편집 가능한 레이아웃, 표, 손글씨는 재현하지 않습니다. OCR 페이지는 이미지와 숨은 텍스트 층으로 바뀌며 해당 페이지의 링크, 양식, 주석, 서명은 유지되지 않습니다. PDF/A 인증이 아닙니다.

다운로드한 결과 확인

사용 전에 인식한 텍스트와 PDF를 원본과 비교하세요. 신뢰도는 추정치이며 정확도를 보장하지 않습니다.

설계상 개인정보 보호

파일은 브라우저에 남습니다. 이 도구는 원본이나 출력을 서버로 업로드하지 않습니다.

질문과 답변

이 도구가 유용한 경우는 언제인가요?

디지털 생성 보고서, 기사, 청구서 및 메모에서 읽을 수 있는 텍스트를 복사하여 검색하거나 편집

브라우저는 실제로 무엇을 하나요?

기본 추출 모드: 브라우저가 각 페이지의 텍스트 항목을 읽고, 대략적인 읽기 순서로 결합하고, 페이지를 구분하며, UTF-8 일반 텍스트 다운로드 생성 문서는 브라우저 메모리에만 유지됩니다. OCR 코드와 선택한 언어 모델은 이 사이트에서 내려받으며 파일 업로드가 아닙니다. 페이지를 떠나거나 지우면 문서와 결과를 버립니다. 이 페이지는 OCR 없이 복사합니다. 스캔 페이지의 머리글만 텍스트이고 나머지 부분을 인식해야 하면 끄세요.

어떤 제한을 이해해야 하나요?

인쇄 문자만 대상으로 하며 오인식할 수 있습니다. 편집 가능한 레이아웃, 표, 손글씨는 재현하지 않습니다. OCR 페이지는 이미지와 숨은 텍스트 층으로 바뀌며 해당 페이지의 링크, 양식, 주석, 서명은 유지되지 않습니다. PDF/A 인증이 아닙니다.

결과를 어떻게 확인해야 하나요?

사용 전에 인식한 텍스트와 PDF를 원본과 비교하세요. 신뢰도는 추정치이며 정확도를 보장하지 않습니다.

관련 도구