# テキスト認識 (OCR)

> オンデバイスのテキスト認識で、スキャンされた DjVu ページを検索可能にします。

Source: https://niraqua.com/ja/djvu/help/text-recognition/

ドキュメントに埋め込みテキストがない場合、Niraqua DjVu はページ上のテキストを
認識(OCR)して、検索や選択ができるようにします。

*iPhone や iPad をお使いの場合は、[iPhone と iPad で使う](https://niraqua.com/ja/djvu/help/ios/)をご覧ください。*

## 使うタイミング

DjVuのページに読める文字が表示されていても、検索可能なテキストが含まれるとは限りません。OCRの誤り、表記の違い、不完全なテキスト層も、検索結果が出ない原因になります。

[DjVuを検索してスキャン文字を認識する](https://niraqua.com/ja/djvu/search-djvu/)

## 認識を実行する

1. **表示 > テキスト認識...**を選ぶか、`⌘` `⇧` `T`
   を押します。
2. ドキュメントの言語を選びます。認識は一度に 1 つの言語を処理するので、
   テキストの大半に合う言語を選んでください。
3. 品質を選びます。**高速**はほとんどのドキュメントに適しており、**高精度**は
   時間がかかりますが、読み取りが難しいスキャンをよりよく認識できます。
4. 次回も同じ言語と品質を使うには、**このドキュメントで記憶**をオンのままに
   しておきます。
5. 確認して開始します。ページの処理中は、進行状況とおおよその所要時間が
   表示されます。

## 対応言語

認識は 15 の言語に対応しています: 英語、フランス語、ドイツ語、スペイン語、
イタリア語、ポルトガル語、ロシア語、ウクライナ語、ポーランド語、オランダ語、
トルコ語、中国語(簡体字)、中国語(繁体字)、日本語、韓国語。

**高速**は英語、フランス語、ドイツ語、スペイン語、イタリア語、ポルトガル語で
利用できます。残りの 9 言語では、**高速**を選んでも**高精度**で認識します。
高速ではこれらを読み取れないためで、シートにもその旨が表示されます。処理時間は
長くなりますが、何も得られないのではなくテキストが得られます。

## 仕組み

- 認識は Apple 内蔵のフレームワークを使って、すべてお使いの Mac 上で実行されます。
  ページの内容がネットワークに送信されることは一切ありません。
- 認識したテキストはキャッシュされ、利用可能な場合は再利用されます。言語や品質を変える場合や誤った結果を置き換える場合は、認識を再実行できます。
- 別の言語や品質で認識をやり直すには(たとえば言語を選び間違えたときなど)、
  もう一度シートを開いて**再実行**を選びます。
- 再実行時は、**既存のテキストレイヤーを置き換える**によって、すでにある
  テキストの扱いが決まります。オンにするとドキュメントの認識済みテキストを
  消去してすべてのページを読み直し、オフにするとまだテキストのないページ
  だけを認識します。言語や品質を変更すると自動的にオンになります。以前の
  テキストは別の設定で得られたものだからです。

## 認識を停止する

実行中の処理を停止するには、**表示 > テキスト認識を停止**を選ぶか、ページ上部の
**テキストを認識中**バナーで**キャンセル**をクリックします。すでに認識済みの
ページは検索可能なままです。

## 認識のあと

認識が終わると、すでにテキストを含むドキュメントと同じように
[検索とテキスト選択](https://niraqua.com/ja/djvu/help/searching/)が使えます。認識したテキストを
そのまま埋め込んだファイルとして共有するには、**OCR を有効にする**をオンにして
[PDF に書き出して](https://niraqua.com/ja/djvu/help/exporting/)ください。
