Практические процессы
Добавить поиск в скан с помощью OCR
Распознайте текст локально и скачайте текстовый файл вместе с PDF, поддерживающим поиск.
Начальные параметры
Распознавание английского, испанского или упрощённого китайского. До 20 МиБ, десяти страниц PDF и 12 мегапикселей на изображение. Страницы с текстом по умолчанию пропускаются.
Этапы обработки
- Загрузите скан или синтетический пример. Выберите язык печатного текста, а не обязательно интерфейса.
- Запустите OCR; модель скачивается по запросу. Если над сканом есть только текстовый заголовок, отключите пропуск страниц с текстом.
- Проверьте распознавание и скачайте результаты. Найдите известную фразу в другом PDF-просмотрщике.
Проверка результата
Сравните имена, числа и важные фрагменты с изображением. Оценка уверенности не доказывает точность.
Ограничения и потери
OCR-страницы становятся растровыми изображениями с невидимым текстом. Редактируемый макет, формы и ссылки не сохраняются. Это не сертифицированное преобразование в PDF/A.
Локальная обработка
Файлы и результаты остаются в браузере; оригиналы не перезаписываются. Примеры содержат вымышленные данные. Скачайте результаты до очистки или выхода. OCR скачивает модель, а не отправляет документ.