Windows OCR

Как распознать скан PDF в Windows и сделать его доступным для поиска

Определите, является ли страница изображением, выберите язык и создайте PDF с текстовым слоем на своём компьютере.

Порядок действий

  1. Попробуйте выделить предложение. Если выделяется только вся страница как изображение, нужен OCR.
  2. Установите в Windows функцию распознавания для языка документа.
  3. В PDFCore откройте Сделать PDF доступным для поиска (рекомендуется), выберите файл, разрешение и установленный язык.
  4. Сохраните под новым именем: исходное изображение останется, а поверх появится поисковый текстовый слой.
  5. Найдите несколько фамилий и чисел, затем скопируйте абзац для проверки порядка чтения.

Что проверить

  • Сверьте имена, даты, суммы, номера документов и знаки с изображением.
  • Отдельно проверьте перекошенные страницы, печати, бледный текст и тонкие линии таблиц.

Ограничения

OCR не восстановит детали, которых нет на изображении. Ровный чёткий скан около 300 dpi обычно распознаётся лучше; рукопись и смазанные фотографии остаются сложными.

Скачать PDFCore 8.0.1