Parcours pratiques

Rendre un scan recherchable avec OCR

Reconnaissez le texte localement et conservez un fichier texte ainsi qu’un PDF permettant la recherche.

Paramètres de départ

Reconnaissance en anglais, espagnol ou chinois simplifié. Maximum 20 Mio, dix pages PDF et douze mégapixels par image. Les pages ayant déjà du texte sont ignorées par défaut.

Étapes du traitement

  1. Chargez un scan ou l’exemple synthétique. Choisissez la langue imprimée, pas nécessairement celle de l’interface.
  2. Lancez l’OCR ; le modèle est téléchargé à la demande. Pour un simple en-tête texte au-dessus d’un scan, désactivez l’omission des pages contenant du texte.
  3. Relisez et téléchargez les résultats. Cherchez une phrase connue dans un autre lecteur PDF.

Vérifier le résultat

Comparez noms, chiffres et passages importants à l’image. Une estimation de confiance ne prouve pas l’exactitude.

Limites et pertes

Les pages OCR deviennent des images avec texte invisible. Mise en page modifiable, formulaires et liens ne sont pas préservés. Ce n’est pas une conversion PDF/A certifiée.

Traitement local

Fichiers et résultats restent dans ce navigateur ; les originaux ne sont pas écrasés. Les exemples utilisent des données fictives. Téléchargez avant d’effacer ou de quitter. L’OCR télécharge son modèle, pas votre document.

Vérifié