PDFテキスト抽出
スキャンしたPDFも含めて、文字をまとめてテキストに。
ここにファイルをドロップ
またはクリックして端末から選択対応形式: PDF
1回あたり3ファイルまで1ファイル20 MBまで1日10回までProで制限を解除✓ オフラインでも利用可能
ファイルは端末の外に出ません
このツールはブラウザ内だけで動作します。アップロードも保存も行わないため、処理を始める前にインターネット接続を切っても問題ありません。
使い方
- PDFをボックスにドロップします。
- 一部のページだけ取り出すなら「1-3, 5」のように入力します。空欄なら全ページです。
- 「文字を読み取る」を押します。文字が入っているページはそのまま読み、スキャンしたページは文字認識で読み取ります(初回は読み取り用データのダウンロードに少し時間がかかります)。
- テキストをコピーするか、テキストファイルとして保存します。
よくある質問
- PDFからコピーできないのですが、これなら取り出せますか?
- スキャンしたPDFはページの画像なので、コピーできる文字がありません。このツールはそうしたページを文字認識で読み取ります。WordなどからPDFにしたファイルには文字が入っているので、認識せずにそのまま取り出します。
- どの言語のスキャンに対応していますか?
- 日本語(横書き・縦書き)、英語、ドイツ語、フランス語、スペイン語、イタリア語、ポルトガル語、トルコ語です。韓国語と中国語のスキャンは読み取れません。
- レイアウトは残りますか?
- 読む順に1行ずつ取り出し、まとまりの間に空行を入れます。段組み・表・フォントは再現しません。表はPDFエクセル変換、編集できる文書はPDFワード変換を使ってください。
- PDFはアップロードされますか?無料の制限は?
- アップロードされません。文字はブラウザ内で読み取ります。無料プランでは1回1ファイル・20MBまで、1日10回まで、スキャンしたページは1回20ページまでです。Proでは制限がなくなります。