pl

PDF na tekst

Wyodrębnij warstwę tekstu z PDF jako zwykły plik .txt, do kopiowania, dalszego użycia lub wyszukiwania. Lokalnie, bez wysyłania.

Przetwarzanie lokalnie na Twoim urządzeniu ...

Twoje pliki

    Przetwarzanie lokalnie na Twoim urządzeniu ...

    0%

    Czy mój plik jest przesyłany?

    Nie. Wszystko działa w Twojej przeglądarce - Twój plik nigdy nie opuszcza urządzenia. Jak to sprawdzić

    Bez wysyłania100% lokalnie
    Treści zostają u Ciebiebrak dostępu osób trzecich
    Hosted in GermanyGlobal Content Delivery
    Zbadane niezależnieTLS A+ · Nagłówki A+

    Kolejność jest odtwarzana strona po stronie: fragmenty tekstu na tej samej wysokości tworzą jeden wiersz, czytany od góry do dołu i od lewej do prawej. Strony są oddzielone pustym wierszem, dzięki czemu wynik łatwo dalej przetwarzać, importować lub przeszukiwać.

    Dane techniczne

    Dane techniczne
    Formaty wejściowePDF
    Automatyczna konwersjaPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    Format wyjściowyTXT
    Przetwarzanie wsadoweNie
    PrzetwarzanieLokalnie w przeglądarce (JavaScript)
    Przesyłanie plikówBrak

    W 3 krokach

    1. Upuść swój plik PDF.
    2. Tekst jest wyodrębniany automatycznie.
    3. Pobierz tekst jako .txt.

    Ograniczenia: Wyodrębnia istniejącą warstwę tekstu z PDF i zwraca ją jako plik .txt w UTF-8; wiersze są odtwarzane z pozycji tekstu. Zeskanowane lub czysto obrazowe PDF nie mają warstwy tekstu, tam wynik pozostaje pusty: użyj wtedy PDF OCR. Czcionki, obrazy, kolory i dokładny układ (strony wielokolumnowe, tabele) są tracone lub jedynie liniowo przybliżane. Zabezpieczone hasłem PDF najpierw odblokuj narzędziem Odblokuj PDF.

    Częste pytania

    Dlaczego mój plik tekstowy jest pusty?

    Prawdopodobnie twój PDF to skan lub składa się z obrazów i nie ma warstwy tekstu. Użyj wtedy PDF OCR, które rozpoznaje tekst z pikseli.

    Czy układ zostaje zachowany?

    Nie. Otrzymujesz czysty tekst w kolejności czytania. Czcionki, obrazy, kolumny i tabele nie są wiernie odwzorowane.

    W jakim kodowaniu jest plik?

    W UTF-8, dzięki czemu poprawnie zachowane są też polskie znaki i znaki specjalne.

    Jak rozdzielane są kolejne strony?

    Pustym wierszem między stronami.

    Czy PDF jest wysyłany?

    Nie, wyodrębnianie tekstu odbywa się w całości lokalnie w przeglądarce.

    Powiązane narzędzia

    PDF OCR wyszukiwalny · PDF na Word · Wyodrębnij strony PDF · PDF na Markdown · DOCX na HTML · DOCX na Markdown