OCRとは
OCR(光学文字認識)は、画像に写っている文字を読み取って、コンピューターで扱えるテキストにする技術です。スキャンしたPDFや写真の文字は「画像」なので、そのままではコピーや検索ができません。OCRで読み取ると、文章として編集・再利用できるようになります。
OCRが役立つ場面
- 紙の書類をスキャンしたPDFから、文章を取り出して再利用する
- 名刺やチラシの写真から、住所や電話番号をテキストにする
- 書籍や資料の一部を、引用のためにテキスト化する
- 画像になっている資料を、Wordで編集できる形にする
- 縦書きの文書を、テキストとして取り出す
読み取りの精度を上げるコツ
- 文字がはっきり写るように、明るい場所で正面から撮影する
- 影や反射、手ぶれが入らないようにする
- 文字が小さすぎる場合は、文字の部分を大きく撮影する
- 縦書きの文書は「日本語(縦書き)」を選ぶ
- 手書きの文字や、装飾の多い書体は読み取りにくいことがあります
読み取った文字には、誤りが含まれることがあります。特に、数字・固有名詞・似た形の文字(「力」と「カ」など)は、必ず元の画像と見比べて確認してください。
読み取った文字の使い方
読み取った文字は、画面上でそのまま修正できます。「すべてコピー」でほかのアプリに貼り付けたり、テキストファイル(.txt)やWordファイル(.docx)で保存したりできます。PDFの場合は、ページごとに区切って表示します。
文字データのあるPDFなら
WordやExcelから作ったPDFのように、もともと文字データがあるPDFは、OCRを使わなくても文字を取り出せます。その場合は「PDF→Word変換」のほうが、速く正確に文章を取り出せます。
画像はサーバーに送信されません
一般的なOCRサービスでは、画像をサーバーに送信して文字を読み取ります。本ツールは、文字認識のプログラムとデータをお使いのブラウザに読み込み、端末の中だけで処理します。個人情報を含む書類も、外部に送信されることはありません。
そのため、処理の速さはお使いの端末の性能によって変わります。ページ数が多いPDFは時間がかかるため、必要なページだけを「PDF分割」で取り出してから読み取るのもおすすめです。