跳转到内容

文本识别 (OCR)

当文稿不含嵌入文本时,Niraqua DjVu 可以识别其页面上的文字(OCR),以便你 搜索和选择。

使用 iPhone 或 iPad?请参阅 iPhone 与 iPad 版

搜索没有结果,或你无法选择任何文本时,请使用文本 识别。这通常意味着该文稿是没有文本层的扫描件。

  1. 选择**显示 > 文本识别…**或按 T
  2. 选取文稿的语言。识别一次只处理一种语言, 因此请选择与大部分文本相符的语言。
  3. 选择质量:快速适合大多数文稿,精准耗时更长, 但能更好地识别难以辨认的扫描件。
  4. 保持打开记住此文稿的设置,下次识别这份文稿时会沿用同样的语言和质量。
  5. 确认后即可开始。处理页面时会显示进度,以及大致所需时间。

识别涵盖 15 种语言:英语、法语、德语、西班牙语、意大利语、葡萄牙语、俄语、 乌克兰语、波兰语、荷兰语、土耳其语、中文(简体)、中文(繁体)、日语和韩语。

快速适用于英语、法语、德语、西班牙语、意大利语和葡萄牙语。对于其余九种 语言,即使你选择“快速”,App 也会以精准质量识别——快速模式读不了这些 语言——表单中也会说明这一点。这样的识别耗时更长,但能得到文本,而不是一无 所获。

  • 识别完全在你的 Mac 上使用 Apple 的内置框架运行。你的页面 内容绝不会通过网络发送。
  • 识别结果会缓存下来,因此一份文稿只需识别一次——以后再次打开 即可立即使用。
  • 如需使用其他语言或质量重新识别——例如选错了语言——请再次打开该表单, 然后选择重新运行
  • 重新运行时,替换现有文本层决定已有文本的去留:打开时会清除文稿中已 识别的文本并重新读取每一页;关闭时只识别尚无文本的页面。更改语言或质量 时会自动为你打开该选项,因为原有文本来自不同的设置。

要停止正在进行的识别,请选择显示 > 停止文本识别,或点按页面上方 正在识别文本横幅中的取消。已经识别的页面仍可搜索。

识别完成后,搜索和文本选择的工作方式与已经 包含文本的文稿完全相同。如果想把识别出的文本一并写入可共享的文件,请在开启 启用 OCR 的情况下导出为 PDF