Распознавание текста PDF
Превратите отсканированные PDF в документы с выделяемым текстом.
Как сделать OCR отсканированного PDF онлайн
Загрузите отсканированный PDF
Перетащите файл или нажмите, чтобы выбрать его с компьютера. Работает с отсканированными или сфотографированными документами без выделяемого текста.
Выберите язык документа
Выберите язык, на котором написан PDF, чтобы распознавание текста было точнее.
Запустите OCR и скачайте
Инструмент добавляет невидимый текстовый слой на каждую страницу, совпадающий с написанным. В итоговом PDF можно искать и выделять текст, как в любом цифровом документе.
Почему использовать OCR для ваших PDF в PDFDocks?
Оптическое распознавание символов (OCR) обычно требует значительных ресурсов, поэтому почти все онлайн-инструменты обрабатывают его на собственном сервере: вы загружаете отсканированный документ, ждёте и скачиваете результат. В PDFDocks OCR работает с помощью Tesseract.js прямо в вашем браузере, используя мощность вашего собственного компьютера или мобильного телефона. Это имеет честный компромисс, который мы предпочитаем вам рассказать: поскольку мы не используем мощный выделенный сервер, процесс может занять немного больше времени для длинных документов, чем в инструментах, обрабатывающих данные в облаке. В обмен ваш отсканированный документ — который может содержать любой тип информации — никогда не покидает ваше устройство. Инструмент добавляет невидимый слой текста, выровненный с написанным, так что полученный PDF имеет доступный для поиска и выделения текст без изменения исходного внешнего вида.
Безопасно ли делать OCR для PDF онлайн в PDFDocks?
+
Да. Ваш файл никогда не загружается на сервер: распознавание текста выполняется прямо в вашем браузере, поэтому PDF никогда не покидает ваш компьютер.
Почему это занимает больше времени, чем другие онлайн-инструменты OCR?
+
Потому что распознавание выполняется с использованием мощности вашего собственного устройства, а не выделенного сервера. В обмен ваш документ никогда не покидает ваш компьютер.
Загружается ли мой отсканированный PDF на сервер?
+
Нет. Все распознавание текста происходит в твоём браузере с помощью Tesseract.js, без передачи файла через интернет.
Могу ли я выбрать язык документа для повышения точности?
+
Да. Выбор правильного языка перед запуском OCR заметно улучшает точность распознавания текста.
Изменяется ли внешний вид PDF после OCR?
+
Нет. Добавляется невидимый текстовый слой, выровненный по написанному тексту; визуально документ выглядит точно так же, как и раньше.
Работает ли это с любым языком или шрифтом?
+
Лучше всего работает с четким печатным текстом на наиболее распространённых языках. При работе с рукописным текстом или низкокачественными сканами точность может снизиться.