PDF テキスト

PDFTXT

PDF からテキストを取り出す

PDF には本物のテキスト層があることも、ページの写真であることもあります。あるテキストを .txt にします。画素から文字は作りません。

公開アップローダにアカウントは不要です。ゲストは 1 日 5 件・250 MB。Business の OST→PST は 0.80 €/GB から。

AI に話しかけると返事します
IACOPO

欲しい結果を書いて、続けて変換します。

抽出は OCR ではない

リーダーで文字を選べるなら抽出対象があります。スキャンは勝手に入力されません。PDF/A は .txt を出しません。

レイアウト

段組みや注は順番が変わることがあります。テキストダンプです。

検証

PDF 由来のテキストであり、暗号化ソースの空ファイルではありません。

質問

スキャン請求書は?

テキスト層がなければ抽出は空です。

PDF も残す?

このジョブはテキストを返します。保存用は PDF から PDF/A を別に。

パスワード付き PDF?

暗号化は迂回しません。自分のパスワードで解除してから送ってください。