eng 寄りの読み取りです。縦書きの日本語や、手書きの書類を期待すると外れます。デジタルPDFのコピーはPDFテキスト抽出の方が先です。
英語のエラー画面をチケットに貼りたい——画像から文字を抜く仕事です。日本語の帳票OCRや、検索可能なPDF化ではありません。
エンジンは英語(eng)優先です。縦書き、はんこ、複写伝票は対象外と考えてください。
向いているとき
- 英語のダイアログ、ログ、仕様書の写真。
- テキスト層の無い英語スキャン。
- クラウドOCRに画面を上げたくない。
すでに文字が選べるPDFならPDFテキスト抽出。iPhone写真が開けないだけならHEICをJPGに変換が先です。
使い方
- この端末の画像を選びます。目安は約 32MB。
- 認識を実行し、テキストをコピーします。
- 誤認識は手で直してください。法的な文字起こし証明ではありません。
しないこと
- 日本語ヘッドの「OCR」を取りにいくこと。
- マイナンバー、パスポート、保険証の自動入力。
- レイアウトを保ったWord化。