# 文本识别 (OCR)

> 通过本机文本识别让扫描的 DjVu 页面变得可搜索。

Source: https://niraqua.com/zh-hans/djvu/help/text-recognition/

当文稿不含嵌入文本时，Niraqua DjVu 可以识别其页面上的文字（OCR），以便你
搜索和选择。

*使用 iPhone 或 iPad？请参阅 [iPhone 与 iPad 版](https://niraqua.com/zh-hans/djvu/help/ios/)。*

## 何时使用

DjVu 页面上显示可读文字，并不意味着文件包含可搜索的文本。OCR 错误、拼写不同或文本层不完整，也可能导致搜索无结果。

[搜索 DjVu 并识别扫描文字](https://niraqua.com/zh-hans/djvu/search-djvu/)

## 运行识别

1. 选择**显示 > 文本识别…**或按
   `⌘` `⇧` `T`。
2. 选取文稿的语言。识别一次只处理一种语言，
   因此请选择与大部分文本相符的语言。
3. 选择质量：**快速**适合大多数文稿，**精准**耗时更长，
   但能更好地识别难以辨认的扫描件。
4. 保持打开**记住此文稿的设置**，下次识别这份文稿时会沿用同样的语言和质量。
5. 确认后即可开始。处理页面时会显示进度，以及大致所需时间。

## 支持的语言

识别涵盖 15 种语言：英语、法语、德语、西班牙语、意大利语、葡萄牙语、俄语、
乌克兰语、波兰语、荷兰语、土耳其语、中文（简体）、中文（繁体）、日语和韩语。

**快速**适用于英语、法语、德语、西班牙语、意大利语和葡萄牙语。对于其余九种
语言，即使你选择“快速”，App 也会以**精准**质量识别——快速模式读不了这些
语言——表单中也会说明这一点。这样的识别耗时更长，但能得到文本，而不是一无
所获。

## 工作原理

- 识别完全在你的 Mac 上使用 Apple 的内置框架运行。你的页面
  内容绝不会通过网络发送。
- 识别的文本会缓存，并在可用时重复使用。你可以重新运行识别，以更改语言或质量，或替换错误的结果。
- 如需使用其他语言或质量重新识别——例如选错了语言——请再次打开该表单，
  然后选择**重新运行**。
- 重新运行时，**替换现有文本层**决定已有文本的去留：打开时会清除文稿中已
  识别的文本并重新读取每一页；关闭时只识别尚无文本的页面。更改语言或质量
  时会自动为你打开该选项，因为原有文本来自不同的设置。

## 停止识别

要停止正在进行的识别，请选择**显示 > 停止文本识别**，或点按页面上方
**正在识别文本**横幅中的**取消**。已经识别的页面仍可搜索。

## 识别之后

识别完成后，[搜索和文本选择](https://niraqua.com/zh-hans/djvu/help/searching/)的工作方式与已经
包含文本的文稿完全相同。如果想把识别出的文本一并写入可共享的文件，请在开启
**启用 OCR** 的情况下[导出为 PDF](https://niraqua.com/zh-hans/djvu/help/exporting/)。
