Перейти к содержимому

Распознавание текста (OCR)

Когда в документе нет встроенного текста, Niraqua DjVu может распознать текст на его страницах (OCR), чтобы вы могли искать и выделять его.

Пользуетесь iPhone или iPad? См. На iPhone и iPad.

Страница DjVu может показывать читаемые слова без текста для поиска. Причиной отсутствия результатов также бывают ошибки OCR, другое написание или неполный текстовый слой.

Поиск в DjVu и распознавание текста на сканах

  1. Выберите Вид > Распознавание текста… или нажмите ⌘ ⇧ T.
  2. Выберите язык документа. Распознавание работает с одним языком за раз, поэтому выберите тот, на котором написана большая часть текста.
  3. Выберите качество: Быстро подходит для большинства документов, Точно занимает больше времени и лучше справляется со сложными сканами.
  4. Оставьте включённым параметр Запомнить для этого документа, чтобы в следующий раз использовать тот же язык и то же качество.
  5. Подтвердите запуск. В процессе обработки страниц отображается прогресс и примерная оценка времени.

Распознавание охватывает 15 языков: английский, французский, немецкий, испанский, итальянский, португальский, русский, украинский, польский, нидерландский, турецкий, китайский (упрощённый), китайский (традиционный), японский и корейский.

Режим Быстро доступен для английского, французского, немецкого, испанского, итальянского и португальского. Для остальных девяти языков приложение распознаёт в качестве Точно, даже если выбрать «Быстро»: быстрый режим их не читает, и приложение об этом предупреждает. Такой проход длится дольше, но даёт текст, а не пустоту.

  • Распознавание выполняется полностью на вашем Mac с помощью встроенных фреймворков Apple. Содержимое ваших страниц никогда не передаётся по сети.
  • Распознанный текст кэшируется и используется повторно, пока доступен. Можно снова запустить распознавание, чтобы изменить язык или качество либо заменить неверный результат.
  • Чтобы распознать текст заново с другим языком или качеством - например, если вы выбрали не тот язык, - откройте окно ещё раз и выберите Запустить снова.
  • При повторном запуске параметр Заменить существующий текстовый слой решает судьбу уже полученного текста: включённый - распознанный текст документа очищается и каждая страница читается заново; выключенный - распознаются только страницы, где текста ещё нет. При смене языка или качества он включается автоматически, ведь прежний текст получен с другими настройками.

Чтобы остановить выполняющийся процесс, выберите Вид > Остановить распознавание текста или нажмите Отмена в баннере Распознавание текста над страницей. Уже распознанные страницы остаются доступными для поиска.

После завершения распознавания поиск и выделение текста работают так же, как для документов, которые уже содержат текст. Чтобы внедрить распознанный текст в файл, которым можно поделиться, экспортируйте в PDF с включённой опцией Включить распознавание текста.