PDF テキスト 抽出
PDFの中の文字を、そのまま使えるテキストとして取り出します。コピーできないPDFから引用したいとき、Wordに貼り直したいときに。取り出したテキストはその場で直せます。処理はすべてこの端末のブラウザ内で完結し、書類はどこにも送信されません。
全機能無料。 使う・確認はそのまま。結果の持ち帰り(ダウンロード)だけ無料の登録を1回お願いしています(メールの用途はメルマガと製品のお知らせのみ)。API・MCP・CLIからの利用はドキュメントへ。
よくある質問
書類はどこかに送られますか?
送られません。読み込みから取り出し・ダウンロードまで、すべてブラウザの中だけで処理します。契約書や社内資料もそのまま扱えます。
スキャンしたPDFからも取り出せますか?
取り出せません。スキャンしたPDFは文字ではなく「紙の写真」が入っているためです。このツールは文字が1つも見つからないとその旨をお知らせするので、その場合はPDF JPG 変換で画像にしてから画像 文字起こし(OCR)にかけてください。
黒塗りした部分の文字も出てきますか?
出てきます。黒い四角を重ねただけのPDFは、下の文字がそのまま残っているためです。自分が作った黒塗りPDFをここに入れて、隠したはずの文字が出てこないかを確認できます。確実に隠す手順はPDFの一部を、確実に隠すにまとめました。
レイアウトは保たれますか?
保たれません。取り出せるのは文字の並びだけで、段組み・表・図の位置は再現されません。表の形のまま扱いたい場合は、PDFではなく元のExcelやCSVを送り主に依頼するのが確実です。
パスワード付きのPDFは開けますか?
開けません。暗号化されたPDFは処理の対象外です。パスワードを解除してからお試しください。