Распознавание текста в PDF

Распознать текст документа, сделав возможным поиск и копирование.

Как это работает:

  • Извлечь текст: Использует Tesseract OCR для распознавания текста на отсканированных изображениях или PDF.
  • Вывод с возможностью поиска: Создаёт новый PDF с невидимым текстовым слоем, делая ваш документ полностью доступным для поиска при сохранении исходного вида.
  • Фильтрация символов: Используйте белые списки для фильтрации нежелательных символов и повышения точности для конкретных типов документов (счета, формы и т.д.).
  • Поддержка нескольких языков: Выберите несколько языков для документов со смешанным языковым содержимым.

Нажмите, чтобы выбрать файл или перетащите его сюда

Ваши файлы не покидают ваше устройство.