Praktische Arbeitsabläufe
Einen Scan mit OCR durchsuchbar machen
Text lokal erkennen und als Textdatei sowie durchsuchbares PDF für spätere Suche speichern.
Startparameter
Erkennung: Englisch, Spanisch oder vereinfachtes Chinesisch. Bis 20 MiB, zehn PDF-Seiten und zwölf Megapixel pro Quellbild. Seiten mit vorhandenem Text werden standardmäßig übersprungen.
Verarbeitungsschritte
- Scan oder synthetisches Textbeispiel laden. Die gedruckte Sprache auswählen, nicht unbedingt die Oberflächensprache.
- OCR starten; das Modell wird bei Bedarf heruntergeladen. Bei einem Textkopf über einem Scan das Überspringen von Textseiten ausschalten.
- Erkennung prüfen und beide Ergebnisse herunterladen. In einem anderen PDF-Reader nach einer bekannten Phrase suchen.
Ergebnis prüfen
Namen, Zahlen und wichtige Stellen mit dem Bild vergleichen. Der Konfidenzwert beweist keine Richtigkeit.
Grenzen und Verluste
OCR-Seiten werden Rasterbilder mit unsichtbarem Text. Editierbares Layout, Formulare und Links bleiben nicht erhalten. Keine zertifizierte PDF/A-Archivierung.
Lokale Verarbeitung
Dateien und Ergebnisse bleiben in diesem Browser; Originale werden nicht überschrieben. Beispiele enthalten erfundene Daten. Vor dem Löschen oder Verlassen herunterladen. OCR lädt sein Modell herunter, nicht Ihr Dokument hoch.