Перейти к содержимому

Распознавание текста (OCR)

Когда в документе нет встроенного текста, Niraqua DjVu может распознать текст на его страницах (OCR), чтобы вы могли искать и выделять его.

Пользуетесь iPhone или iPad? См. На iPhone и iPad.

Используйте распознавание текста, когда поиск ничего не находит или вы не можете выделить текст. Обычно это означает, что документ - это скан без текстового слоя.

  1. Выберите Вид > Распознавание текста… или нажмите T.
  2. Выберите язык документа. Распознавание работает с одним языком за раз, поэтому выберите тот, на котором написана большая часть текста.
  3. Выберите качество: Быстро подходит для большинства документов, Точно занимает больше времени и лучше справляется со сложными сканами.
  4. Оставьте включённым параметр Запомнить для этого документа, чтобы в следующий раз использовать тот же язык и то же качество.
  5. Подтвердите запуск. В процессе обработки страниц отображается прогресс и примерная оценка времени.

Распознавание охватывает 15 языков: английский, французский, немецкий, испанский, итальянский, португальский, русский, украинский, польский, нидерландский, турецкий, китайский (упрощённый), китайский (традиционный), японский и корейский.

Режим Быстро доступен для английского, французского, немецкого, испанского, итальянского и португальского. Для остальных девяти языков приложение распознаёт в качестве Точно, даже если выбрать «Быстро»: быстрый режим их не читает, и приложение об этом предупреждает. Такой проход длится дольше, но даёт текст, а не пустоту.

  • Распознавание выполняется полностью на вашем Mac с помощью встроенных фреймворков Apple. Содержимое ваших страниц никогда не передаётся по сети.
  • Результаты кэшируются, поэтому документ нужно распознать только один раз - при повторном открытии всё доступно мгновенно.
  • Чтобы распознать текст заново с другим языком или качеством - например, если вы выбрали не тот язык, - откройте окно ещё раз и выберите Запустить снова.
  • При повторном запуске параметр Заменить существующий текстовый слой решает судьбу уже полученного текста: включённый - распознанный текст документа очищается и каждая страница читается заново; выключенный - распознаются только страницы, где текста ещё нет. При смене языка или качества он включается автоматически, ведь прежний текст получен с другими настройками.

Чтобы остановить выполняющийся процесс, выберите Вид > Остановить распознавание текста или нажмите Отмена в баннере Распознавание текста над страницей. Уже распознанные страницы остаются доступными для поиска.

После завершения распознавания поиск и выделение текста работают так же, как для документов, которые уже содержат текст. Чтобы внедрить распознанный текст в файл, которым можно поделиться, экспортируйте в PDF с включённой опцией Включить распознавание текста.