Fluxos práticos

Tornar uma digitalização pesquisável

Reconheça texto localmente com OCR e baixe texto simples e PDF pesquisável.

Parâmetros iniciais

Reconhecimento em inglês, espanhol ou chinês simplificado. Até 20 MiB, dez páginas PDF e 12 megapixels por imagem. Páginas com texto existente são ignoradas por padrão.

Etapas de processamento

  1. Carregue uma digitalização ou o exemplo sintético. Escolha o idioma impresso, não necessariamente o idioma da interface.
  2. Inicie OCR; o modelo é baixado sob demanda. Se houver só um cabeçalho textual sobre a imagem, desative a opção de ignorar páginas com texto.
  3. Revise e baixe os resultados. Pesquise uma frase conhecida em outro leitor PDF.

Verificar resultado

Compare nomes, números e trechos importantes com a imagem. Uma estimativa de confiança não comprova precisão.

Limites e perdas

As páginas OCR viram imagens com texto invisível. Layout editável, formulários e links não são preservados. Não é conversão certificada para PDF/A.

Processamento local

Arquivos e resultados ficam neste navegador; os originais não são substituídos. Os exemplos usam dados fictícios. Baixe antes de limpar ou sair. O OCR baixa o modelo, não envia seu documento.

Revisado