PDFをテキストに
PDFのテキスト層をシンプルな.txtファイルとして抽出します。コピー、再利用、検索に。ローカル、アップロードなし。
お使いの端末でローカル処理中 ...
ファイル
お使いの端末でローカル処理中 ...
0%
ファイルは一度も端末から出ていません
私のファイルはアップロードされますか?
いいえ。すべてブラウザ内で動作します。あなたのファイルが端末から出ることはありません。これが検証できる理由
PDFのテキスト層をシンプルな.txtファイルとして抽出します。コピー、再利用、検索に。ローカル、アップロードなし。
お使いの端末でローカル処理中 ...
お使いの端末でローカル処理中 ...
0%
ファイルは一度も端末から出ていません
いいえ。すべてブラウザ内で動作します。あなたのファイルが端末から出ることはありません。これが検証できる理由
順序はページごとに再構築されます。同じ高さにあるテキスト片が1行としてまとめられ、上から下、左から右の順に読み取られます。ページ間は空行で区切られるため、出力結果をそのまま再利用したり、インポートしたり、検索したりしやすくなっています。
| 入力形式 | |
|---|---|
| 自動変換 | PNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP |
| 出力形式 | TXT |
| 一括処理 | 非対応 |
| 処理 | ブラウザ内でローカル処理 (JavaScript) |
| ファイルのアップロード | なし |
制限: PDFの既存のテキスト層を抽出し、UTF-8の.txtファイルとして返します。行はテキストの位置から復元されます。スキャンしたPDFや画像のみのPDFにはテキスト層がなく、出力は空になります。その場合はPDF OCRを使ってください。書体、画像、色、正確なレイアウト(複数段組みのページ、表)は失われるか、線形に近似されるだけです。パスワード付きPDFは先にPDFロック解除で開いてください。
おそらくあなたのPDFはスキャンか画像でできていて、テキスト層がありません。その場合は、ピクセルからテキストを認識するPDF OCRを使ってください。
いいえ。読み順の純粋なテキストが得られます。書体、画像、段組み、表は忠実には再現されません。
UTF-8です。日本語や特殊文字も正しく保たれます。
ページ間は空行で区切られます。
いいえ、テキスト抽出はすべてブラウザ内でローカルに行われます。
PDF OCR 検索可能化 · PDFをWordに · PDFページを抽出 · PDFをMarkdownに変換 · DOCXをHTMLへ · DOCXをMarkdownへ