Практические процессы

Добавить поиск в скан с помощью OCR

Распознайте текст локально и скачайте текстовый файл вместе с PDF, поддерживающим поиск.

Начальные параметры

Распознавание английского, испанского или упрощённого китайского. До 20 МиБ, десяти страниц PDF и 12 мегапикселей на изображение. Страницы с текстом по умолчанию пропускаются.

Этапы обработки

  1. Загрузите скан или синтетический пример. Выберите язык печатного текста, а не обязательно интерфейса.
  2. Запустите OCR; модель скачивается по запросу. Если над сканом есть только текстовый заголовок, отключите пропуск страниц с текстом.
  3. Проверьте распознавание и скачайте результаты. Найдите известную фразу в другом PDF-просмотрщике.

Проверка результата

Сравните имена, числа и важные фрагменты с изображением. Оценка уверенности не доказывает точность.

Ограничения и потери

OCR-страницы становятся растровыми изображениями с невидимым текстом. Редактируемый макет, формы и ссылки не сохраняются. Это не сертифицированное преобразование в PDF/A.

Локальная обработка

Файлы и результаты остаются в браузере; оригиналы не перезаписываются. Примеры содержат вымышленные данные. Скачайте результаты до очистки или выхода. OCR скачивает модель, а не отправляет документ.

Проверено