ja

PDFをテキストに

PDFのテキスト層をシンプルな.txtファイルとして抽出します。コピー、再利用、検索に。ローカル、アップロードなし。

お使いの端末でローカル処理中 ...

ファイル

    お使いの端末でローカル処理中 ...

    0%

    私のファイルはアップロードされますか?

    いいえ。すべてブラウザ内で動作します。あなたのファイルが端末から出ることはありません。これが検証できる理由

    アップロード不要100%ローカル処理
    中身は手元のまま第三者のアクセスなし
    Hosted in GermanyGlobal Content Delivery
    第三者による検証済みTLS A+ · ヘッダー A+

    順序はページごとに再構築されます。同じ高さにあるテキスト片が1行としてまとめられ、上から下、左から右の順に読み取られます。ページ間は空行で区切られるため、出力結果をそのまま再利用したり、インポートしたり、検索したりしやすくなっています。

    技術仕様

    技術仕様
    入力形式PDF
    自動変換PNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    出力形式TXT
    一括処理非対応
    処理ブラウザ内でローカル処理 (JavaScript)
    ファイルのアップロードなし

    3ステップで

    1. PDFをドロップします。
    2. テキストが自動的に抽出されます。
    3. テキストを.txtでダウンロードします。

    制限: PDFの既存のテキスト層を抽出し、UTF-8の.txtファイルとして返します。行はテキストの位置から復元されます。スキャンしたPDFや画像のみのPDFにはテキスト層がなく、出力は空になります。その場合はPDF OCRを使ってください。書体、画像、色、正確なレイアウト(複数段組みのページ、表)は失われるか、線形に近似されるだけです。パスワード付きPDFは先にPDFロック解除で開いてください。

    よくある質問

    テキストファイルが空なのはなぜですか?

    おそらくあなたのPDFはスキャンか画像でできていて、テキスト層がありません。その場合は、ピクセルからテキストを認識するPDF OCRを使ってください。

    レイアウトは保たれますか?

    いいえ。読み順の純粋なテキストが得られます。書体、画像、段組み、表は忠実には再現されません。

    ファイルの文字コードは何ですか?

    UTF-8です。日本語や特殊文字も正しく保たれます。

    複数ページはどう区切られますか?

    ページ間は空行で区切られます。

    PDFはアップロードされますか?

    いいえ、テキスト抽出はすべてブラウザ内でローカルに行われます。

    関連ツール

    PDF OCR 検索可能化 · PDFをWordに · PDFページを抽出 · PDFをMarkdownに変換 · DOCXをHTMLへ · DOCXをMarkdownへ