【おーしーあーる】
OCR(光学文字認識) とは?
最終更新:
💡 画像の文字を、使えるテキストへ
画像に写った文字を、検索や編集に使えるテキストに変換する技術。読み取りの誤り、画像の品質、表や項目の抽出との違いを解説します。
📌 このページのポイント
- Optical Character Recognitionの略
- 写真やスキャン画像の文字をテキストとして認識
- 精度は画像・文字・対応言語などの条件で変わる
- 重要な値は原本と照合し、表の構造も確認する
紙の書類を、検索できる文字にしたい!
スキャンや写真で画像にしてから、OCRで文字を認識する方法がある。画像のままでは扱いにくい文字を、コピーや検索に使えるテキストにできるんだ。
スキャンしただけで、文字になる?
一文字ずつ切り出して読むの?
実装はさまざまだ。文字のある場所や行を見つけ、認識する処理などを組み合わせる。すべてのOCRが同じ三段階で動くと決めつけることはできない。
手書きも読める?
手書きに対応するサービスもある。ただし対応する言語や書き方、画像の状態で結果が変わる。印刷された文字でも、ぼけや傾き、汚れなどで読み違えることがあるよ。
ほぼ100%正しいと思ってよい?
条件なしの精度は言えない。金額や日付、識別番号などは原本と照合する。信頼度のスコアを出す製品でも、スコアが高いことと、その値が必ず正しいことは別だ。
表や請求書も、そのまま整理できる?
文字を読むことに加え、行・列や項目との関係を取り出す機能が必要になる。OCRとレイアウト解析や帳票の抽出を組み合わせる製品もある。保存前に文字だけでなく対応関係も確認しよう。
もっと詳しく知りたい人へ
読み取りが悪いときは、どうする?
原本を見て、画像のぼけ・傾き・影などを確認します。撮り直しや傾きの補正、対応言語や認識範囲の指定が役立つ場合があります。改善方法は製品や入力によるため、同じ書類で結果を比べます。
機密の書類を、どのOCRにも送ってよい?
書類には個人情報や社内情報が含まれることがあります。処理が端末内か外部サービスか、保存や利用の条件、所属組織の規則を確認してから使います。OCRという技術名だけでは、データの送信先は分かりません。
まとめ:ざっくりこれだけ覚えればOK!
「OCR」って出てきたら「画像に写った文字を認識して、検索や編集に使えるテキストに変換する技術」と思えばだいたいOK!
📖 おまけ:英語の意味
「Optical Character Recognition」 = 光学文字認識
💬 画像に含まれる文字を認識する技術の名前です。紙をスキャナーで取り込む操作そのものではなく、すでにあるデジタル画像にも利用できます。