PDF テキスト 抽出

PDFの中の文字を、そのまま使えるテキストとして取り出します。コピーできないPDFから引用したいとき、Wordに貼り直したいときに。取り出したテキストはその場で直せます。処理はすべてこの端末のブラウザ内で完結し、書類はどこにも送信されません。

全機能無料。 使う・確認はそのまま。結果の持ち帰り(ダウンロード)だけ無料の登録を1回お願いしています(メールの用途はメルマガと製品のお知らせのみ)。API・MCP・CLIからの利用はドキュメントへ。

よくある質問

書類はどこかに送られますか?

送られません。読み込みから取り出し・ダウンロードまで、すべてブラウザの中だけで処理します。契約書や社内資料もそのまま扱えます。

スキャンしたPDFからも取り出せますか?

取り出せません。スキャンしたPDFは文字ではなく「紙の写真」が入っているためです。このツールは文字が1つも見つからないとその旨をお知らせするので、その場合はPDF JPG 変換で画像にしてから画像 文字起こし(OCR)にかけてください。

黒塗りした部分の文字も出てきますか?

出てきます。黒い四角を重ねただけのPDFは、下の文字がそのまま残っているためです。自分が作った黒塗りPDFをここに入れて、隠したはずの文字が出てこないかを確認できます。確実に隠す手順はPDFの一部を、確実に隠すにまとめました。

レイアウトは保たれますか?

保たれません。取り出せるのは文字の並びだけで、段組み・表・図の位置は再現されません。表の形のまま扱いたい場合は、PDFではなく元のExcelやCSVを送り主に依頼するのが確実です。

パスワード付きのPDFは開けますか?

開けません。暗号化されたPDFは処理の対象外です。パスワードを解除してからお試しください。

PDFの道具

この道具を使う手順