Сделать скан PDF доступным для поиска
Скан — это картинка документа: в нём нельзя искать, выделить фразу или скопировать абзац. OCR добавляет невидимый текстовый слой позади изображения, поэтому страницы выглядят так же, а слова становятся настоящим текстом.
Конвертируется на наших серверах, удаляется сразу после
Как пользоваться
- 1
Выберите язык документа — OCR должен знать, какой алфавит распознавать.
- 2
Добавьте отсканированный PDF.
- 3
Скачайте PDF с возможностью поиска и попробуйте Ctrl+F внутри него.
Вопросы и ответы
Документ выглядит по-другому после обработки?
Нет. Скан остаётся нетронутым; распознанный текст ложится невидимо позади него — поэтому можно выделять слова, которые выглядят частью картинки.
Что, если на части страниц уже есть текст?
Их не трогают. Обрабатываются только страницы-картинки, так что смешанные документы обрабатываются безопасно.
Насколько это точно?
Чистые сканы печатного текста с разрешением 300 dpi распознаются почти идеально. Рукописный текст не поддерживается, а кривое фото страницы с телефона разочарует.
Какие языки поддерживаются?
Английский, русский, украинский, немецкий, французский, испанский, португальский, польский и турецкий. Выбирайте язык документа, а не язык интерфейса.
Файл загружается на сервер?
Да — OCR целого PDF браузеру не под силу. Обработка идёт на наших серверах, а файл удаляется сразу после готовности результата.