PDFテキスト抽出

このブラウザ内で処理

ファイル上限: 32 MB

このツールは入力をアップロードしません。

ファイルをドロップ

ファイルをドロップするか選択してください。

例:この端末の PDF を選び、処理します。アップロードしません。

初回はブラウザ内でライブラリをダウンロードする場合があります。

契約の電子版から条文を抜きたいとき。JPEG再描画した圧縮結果からは戻りません。

電子の約款から条文をコピーしたい——テキスト層の抽出です。カメラの住民票や、漢字だらけのスキャンは対象外に近いです。英語の画面なら英語OCReng。マイナンバー製品ではない)。

PDF圧縮のあとでは、たいてい戻れません。ページだけ要るならPDF分割です。

就活と契約で使うとき

募集要項のPDFから、提出先住所を抜き出す用途です。スキャンの成績証明は、層が無ければ空です。クラウドOCRに上げたくないときの、デジタルPDF向けです。

使い方

  1. テキストが選べるPDFを入れます。目安は約 32MB
  2. 抽出してコピーします。
  3. 空なら、英語活字に限ってOCRを検討します。日本語帳票の本命ではありません。

OCRにしないこと

縦書き、はんこ、手書き、公的書類の自動入力はありません。

よくある質問

スキャンの住民票は読めますか?

テキスト層が無ければ、ほぼ空です。英語の印刷物なら英語OCR(eng)を試せます。日本語OCRの本命は追いません。

圧縮したあと抽出できますか?

JPEG再描画のあと、文字層は失われます。先に抽出するか、元ファイルを残してください。

身分証を読みますか?

しません。載せないでください。

ページ順を変えたいです。

PDFページ整理へ。

アップロードされますか?

されません。目安32MBです。

関連ツール