Оптимизировать PDF
Что делает OCR PDF?
Легко преобразуйте отсканированные PDF в документы с доступным для поиска и выделения содержимым.
Как использовать OCR PDF
- 1Выбрать исходные файлы
Чтобы продолжить, добавьте хотя бы один поддерживаемый файл. PDF.
- 2Запустить OCR
автоматический или выбранный язык OCR; текстовый слой с возможностью поиска
- 3Скачать результат
Формат результата: PDF. Добавляет выделяемый текст OCR с возможностью поиска; не восстанавливает исходную вёрстку для редактирования
Поддерживаемые файлы и ограничения
- Формат результата: PDF
- Вход: PDF
- Параметры результата: автоматический или выбранный язык OCR; текстовый слой с возможностью поиска
- один PDF на задачу; распознавание зависит от качества сканирования и языковых данных
- Файлы остаются на этом устройстве и удаляются при закрытии страницы.
один PDF на задачу; распознавание зависит от качества сканирования и языковых данных
Что сохраняет результат
- исходное изображение страницы
- порядок страниц
Добавляет выделяемый текст OCR с возможностью поиска; не восстанавливает исходную вёрстку для редактирования
Что может измениться или пропасть
- точность распознавания имён, чисел, рукописного текста и редких символов
один PDF на задачу; распознавание зависит от качества сканирования и языковых данных
Когда не использовать этот инструмент
Не используйте OCR PDF, если источник вне PDF. Не используйте его, если нужно сохранить точность распознавания имён, чисел, рукописного текста и редких символов без изменений. Опубликованное ограничение: один PDF на задачу.
Если обработка не удалась
Если браузер не может прочитать файл, он может быть защищён паролем или повреждён. Сначала снимите защиту или восстановите файл, затем повторите попытку. один PDF на задачу; распознавание зависит от качества сканирования и языковых данных В результате также может отсутствовать: точность распознавания имён, чисел, рукописного текста и редких символов.
Граница конфиденциальности
Файлы остаются на этом устройстве и удаляются при закрытии страницы. PDF Smart Kit не отправляет содержимое выбранного файла на сервер приложения.
Свидетельства тестов
Последний тест: · Тестовый браузер: Настольный Chrome через Chromium в Playwright · Версия продукта: 1.0.0
Образец: Страница PDF в виде изображения с печатным текстом латиницей · 1 стр.
Что проверялось
- Загруженный файл является корректным PDF.
- После OCR печатного образца присутствует текстовый слой с возможностью поиска.
- Для распознавания используется именно выбранный языковой пакет.
Известные сбои и ограничения
- Рукописный текст, сканы с низким контрастом и редкие шрифты по-прежнему требуют ручной проверки.
- OCR не восстанавливает исходную структуру документа или шрифты.