跳转到内容

如何将 DjVu 转换为 PDF

.djvu 文件转换成 PDF,通常是为了兼容性:DjVu 让扫描书籍既小又清晰,但 同事、打印店、电子阅读器和各类提交系统真正接受的是 PDF。

关键在于,转换时不能丢掉扫描件真正有用的地方——页面的清晰度,以及搜索其中 文本的能力——而且不必把文稿交给某个网站。

  1. 打开文稿。 在访达中双击该 .djvu 文件。
  2. 确认文本是否可搜索。 按 Command-F,搜索一个你在屏幕上看得见的词。 如果能找到,说明文件已经带有文本层。如果找不到,页面就只是图像。
  3. 必要时先识别文本。 运行文本识别, 导出时才有内容可以写入 PDF 的文本层。识别在你的 Mac 上运行,一本长书可能 需要几分钟。
  4. 选择“文件 > 导出为 PDF”。
  5. 选取设置。 选择一个质量预设,如果希望 PDF 可搜索,请打开可搜索的 文本层。
  6. 存储。 PDF 会直接写入你选择的文件夹。

完整细节请参阅存储和导出

iOS 和 iPadOS 上有同样的导出功能。打开文稿,如果扫描件没有文本就先运行文本 识别,然后导出为 PDF,再通过共享表单发送到“文件”App、“邮件”或任意其他 App。 识别和导出会在你使用其他 App 时继续运行,并在锁定屏幕和灵动岛上显示进度。

请参阅 iPhone 与 iPad 版

扫描页面很特别:页面的大部分都是空白纸张,真正重要的是那些纤细的黑色笔画。 压缩过度会让笔画变得毛糙,读起来很累。

  • 是任何你打算阅读或打印的文稿的正确默认值,页面看起来和原件一样。
  • 更低的预设适合只用来速览或用邮件发送的文件,这时文件大小比字形的观感 更重要。

导出的 PDF 通常比原来的 DjVu 更大。这是意料之中的:在这件具体的事情上, DjVu 的分层压缩确实更胜一筹。请参阅 DjVu 与 PDF 对比

没有文本层,一份扫描书籍的 PDF 就是一叠图片:你无法搜索它,无法选取一段 引文,也无法复制一条引注。有了它,文本就隐形地藏在页面图像背后,任何 PDF 阅读器都能搜索,而扫描件看上去仍与原始页面一模一样。

如果 DjVu 本身已带有文本层,导出时会直接复用。如果没有,本机识别会先生成 一个。

把文稿上传到转换网站,等于把它的完整副本交给了第三方。对于一份公版扫描件, 这也许无所谓;但对于未发表的手稿、有版权的期刊论文、法律文件,或任何带有 名字的内容,这就很要紧。

在线转换器还往往会把页面压平成纯图像,从而丢掉文本层;它们的大小限制,一本 400 页的扫描书籍也很容易超出。

Niraqua DjVu 在你自己的机器上完成转换。没有任何网络请求,无需账户,你的文稿 除了你的设备之外不会留下任何副本。

获取 Niraqua DjVu,支持 Mac、iPhone 和 iPad,一次购买即可 覆盖三个平台。