id

PDF ke teks

Ekstrak lapisan teks sebuah PDF sebagai berkas .txt sederhana, untuk disalin, dipakai ulang, atau dicari. Lokal, tanpa unggah.

Memproses secara lokal di perangkat Anda ...

Berkas Anda

    Memproses secara lokal di perangkat Anda ...

    0%

    Apakah berkas saya diunggah?

    Tidak. Semuanya berjalan di peramban Anda - berkas Anda tidak pernah meninggalkan perangkat. Bagaimana ini dapat diverifikasi

    Tanpa unggahan100% lokal
    Isi tetap milikmutanpa akses pihak ketiga
    Hosted in GermanyGlobal Content Delivery
    Diaudit independenTLS A+ · HTTP header A+

    Urutan direkonstruksi halaman demi halaman: potongan teks pada ketinggian yang sama membentuk satu baris, dibaca dari atas ke bawah dan kiri ke kanan. Halaman dipisahkan oleh satu baris kosong, sehingga hasilnya mudah diolah lebih lanjut, diimpor, atau dicari.

    Data teknis

    Data teknis
    Format masukanPDF
    Konversi otomatisPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    Format keluaranTXT
    Pemrosesan massalTidak
    PemrosesanLokal di peramban (JavaScript)
    Unggah berkasTidak ada

    Dalam 3 langkah

    1. Letakkan PDF Anda.
    2. Teks diekstrak secara otomatis.
    3. Unduh teks sebagai .txt.

    Batasan: Mengekstrak lapisan teks yang ada pada sebuah PDF dan mengembalikannya sebagai berkas .txt dalam UTF-8; baris disusun ulang dari posisi teks. PDF hasil pindai atau hanya gambar tidak punya lapisan teks, di situ hasilnya kosong: pakai PDF OCR. Fon, gambar, warna, dan tata letak persis (halaman berkolom banyak, tabel) hilang atau hanya didekati secara linear. Buka kunci dulu PDF berkata sandi dengan Buka kunci PDF.

    Pertanyaan umum

    Mengapa berkas teks saya kosong?

    Kemungkinan PDF Anda adalah hasil pindai atau terdiri dari gambar dan tidak punya lapisan teks. Pakai PDF OCR, yang mengenali teks dari piksel.

    Apakah tata letak dipertahankan?

    Tidak. Anda mendapat teks murni dalam urutan baca. Fon, gambar, kolom, dan tabel tidak direproduksi secara persis.

    Berkas dalam pengodean apa?

    UTF-8, sehingga huruf beraksen dan karakter khusus pun tetap terjaga dengan benar.

    Bagaimana beberapa halaman dipisahkan?

    Dengan satu baris kosong di antara halaman.

    Apakah PDF diunggah?

    Tidak, ekstraksi teks terjadi sepenuhnya secara lokal di peramban.

    Alat terkait

    PDF OCR (dapat dicari) · PDF ke Word · Ekstrak halaman PDF · PDF ke Markdown · DOCX ke HTML · DOCX ke Markdown