Как использовать OCR с MobiPDF на Android

Благодаря расширенной функции распознавания текста (OCR) в MobiPDF вы теперь можете раскрыть весь потенциал отсканированных документов, оптимизировать рабочие процессы и повысить производительность. В этой статье мы подробно рассмотрим, как работает OCR в MobiPDF и как она может изменить ваш опыт управления документами.

 

Для чего используется OCR?

OCR (оптическое распознавание символов) — это технология распознавания текста, которая позволяет преобразовывать отсканированные файлы в PDF-файлы с возможностью поиска текста. Она также помогает преобразовывать отсканированные документы в редактируемые документы офисного формата, сохраняя при этом целостность содержимого файла.

Как это работает?

Инструмент оптического распознавания символов (OCR) преобразует распознанные фигуры и узоры в машиночитаемый текст и создает невидимый текстовый слой. Это сохраняет внешний вид исходного файла, но позволяет пользователю искать, выделять, копировать и выделять текст.

Кончик: Убедитесь, что ваш файл состоит преимущественно из читаемого текста с чистым фоном.

 

Вот как сделать отсканированные изображения доступными для поиска с помощью OCR.

1. Откройте MobiPDF. Нажмите Сканировать в PDF.

annotely_image (21).png

2. Отсканируйте документ.

1000020264.jpg

3. После сканирования нажмите Сделать доступным для поискаЭта функция должна быть всегда включена по умолчанию, если вы ее ранее не отключили.

annotely_image (23).png

4. Нажмите кнопку «Сохранить». И приложение начнет распознавать этот текст, после чего появится соответствующий значок.

annotely_image (26).png

5. Сохраните файл.

annotely_image (27).png

6. Откроется только что сохраненный файл. Теперь в нем можно осуществлять поиск. Нажмите Поиск Выберите пункт меню и введите ключевое слово.

annotely_image (30).png annotely_image (31).png

7. Нажмите для ввода текста Если вы хотите экспортировать информацию из вашего PDF-файла в формат .txt.

annotely_image (24).png

8. Выберите Поделиться текстомКопировать текстили Экспорт в TXT.

annotely_image (25).png

9. Теперь вы можете открыть файл с помощью MobiOffice.

1000019223.jpg

 

Сделайте существующий PDF-файл доступным для поиска: 

1. Откройте PDF-файл на своем устройстве.

annotely_image (30).png

2. Нажмите на значок меню, а затем на Распознать текст. 

annotely_image (27).png

3. Нажмите для ввода текста Если вы хотите экспортировать информацию из вашего PDF-файла в формат .txt. 

annotely_image (32).png

4. Выберите Поделиться текстомКопировать текстили Экспорт в TXT

annotely_image (28).png

5. Нажмите Сделать доступным для поиска.

annotely_image (33).png

6. Нажмите Поиск.

annotely_image (29).png

7. Теперь вы можете выполнить поиск по файлу, и все результаты будут выделены.

1000020276.jpg

 

Ограничения

Хотя оптическое распознавание символов (OCR) — мощный инструмент, не все документы подходят для его обработки.
Обработано. К числу ограничений относятся:

  • Некоторые элементы могут быть недоступны для редактирования.
  • трудности при обработке файлов со сложным фоном
  • Возможно, потребуется ручная доработка/коррекция после конвертации.
  • легко подвержена влиянию качества сканирования

Мы надеемся, что эта статья помогла вам четко понять, как функция распознавания текста (OCR) в MobiPDF может улучшить ваш опыт управления документами. Благодаря возможности преобразования документов в редактируемые файлы с возможностью поиска, MobiPDF помогает вам повысить эффективность и производительность.

Была ли эта статья полезной?

Пользователи, считающие этот материал полезным: 3 из 3