画像・スキャン文書から文字を抽出する方法(OCR)

写真やスキャン画像から編集可能な文字を取り出す作業は、以前よりずっと手軽になっています。手持ちのツールでできる方法をまとめました。

  1. スマートフォンのカメラ内蔵の文字認識を使う

    最近のスマートフォンのカメラ・写真アプリの多くは、カメラをかざした画面や保存済みの写真の中の文字を直接検出でき、別アプリなしでそのまま選択・コピー・貼り付けができます。

  2. ちょっとした抽出にはGoogleレンズを使う

    カメラや既存の画像に写っている文字にGoogleレンズをかざすと、瞬時に文字を認識してコピー・翻訳・検索ができます。設定不要でさっと1回だけ抽出したいときに便利です。

  3. 文書やPDFにはブラウザ型の無料OCRサイトを使う

    1枚の写真ではなくスキャン文書やPDF全体を処理したい場合は、専用のOCRサイトでファイルをまとめて処理し、編集可能なテキストや検索可能なPDFとして書き出せます。

  4. オフィスソフトの内蔵OCR機能を使う

    Microsoft OneNoteやGoogleドキュメント(画像やスキャンPDFを「Googleドキュメントで開く」)には内蔵OCR機能があり、普段の作業の流れの中で文字を抽出できます。

  5. 精度が悪い場合は先に画像の質を上げる

    ぼやけた画像、傾いた画像、低解像度、コントラストの低い画像ではOCRの精度が大きく下がります。明るい場所でカメラをまっすぐ構え、反射を避けて撮り直すだけで結果が目に見えて改善します。

  6. 抽出結果を必ず見直す

    OCRは形の似た文字(「0」と「O」、「l」と「1」など)を誤認識することがあるため、特に数字や固有名詞、そのまま使う予定の内容は必ず見直しましょう。

OCRが実際に行っていること

OCRソフトは人間のように文字を「読んで」いるわけではなく、画像内の形やパターンを分析し、既知の文字の形と照合して最も可能性の高い文字を予測しています。そのため一般的な書体で印刷されたきれいな文字には非常に強い一方、手書き文字や装飾的なフォント、質の低いスキャンでは形のパターンが読みにくくなり、精度が大きく落ちます。

用途に合ったOCRツールの選び方

看板の文字や引用文、電話番号などをその場でさっと取りたいならGoogleレンズのようなカメラ型ツールが最適です。一方、多数のページやスキャン文書全体をまとめて処理したい場合は、複数ページ処理を前提に設計された専用OCRツールやオフィスソフトの機能のほうが、1枚ずつカメラツールを繰り返すより速く正確です。

よくある質問

鮮明な写真でもOCRが特定の文字を間違えるのはなぜですか?

大文字の「I」、小文字の「l」、数字の「1」のように、多くのフォントでほぼ同じ形になる文字が存在するため、鮮明な画像でもOCRが混同することがあります。結果を確認して修正するのは一般的な工程であり、ツールの不具合とは限りません。

手書き文字もOCRで抽出できますか?

基本的なOCRは印刷された文字を前提に作られており、手書き文字は苦手です。手書き認識に対応した新しいツールもありますが、印刷文字と比べると精度はまだ明らかに低く、特に読みにくい筆跡では誤認識が増えます。