Praktische Arbeitsabläufe

Einen Scan mit OCR durchsuchbar machen

Text lokal erkennen und als Textdatei sowie durchsuchbares PDF für spätere Suche speichern.

Startparameter

Erkennung: Englisch, Spanisch oder vereinfachtes Chinesisch. Bis 20 MiB, zehn PDF-Seiten und zwölf Megapixel pro Quellbild. Seiten mit vorhandenem Text werden standardmäßig übersprungen.

Verarbeitungsschritte

  1. Scan oder synthetisches Textbeispiel laden. Die gedruckte Sprache auswählen, nicht unbedingt die Oberflächensprache.
  2. OCR starten; das Modell wird bei Bedarf heruntergeladen. Bei einem Textkopf über einem Scan das Überspringen von Textseiten ausschalten.
  3. Erkennung prüfen und beide Ergebnisse herunterladen. In einem anderen PDF-Reader nach einer bekannten Phrase suchen.

Ergebnis prüfen

Namen, Zahlen und wichtige Stellen mit dem Bild vergleichen. Der Konfidenzwert beweist keine Richtigkeit.

Grenzen und Verluste

OCR-Seiten werden Rasterbilder mit unsichtbarem Text. Editierbares Layout, Formulare und Links bleiben nicht erhalten. Keine zertifizierte PDF/A-Archivierung.

Lokale Verarbeitung

Dateien und Ergebnisse bleiben in diesem Browser; Originale werden nicht überschrieben. Beispiele enthalten erfundene Daten. Vor dem Löschen oder Verlassen herunterladen. OCR lädt sein Modell herunter, nicht Ihr Dokument hoch.

Geprüft