bg

PDF в текстов файл

Извлечете текстовия слой на PDF като обикновен .txt файл, за копиране, повторна употреба или търсене. Локално, без качване.

Обработва се локално на устройството ви ...

Вашите файлове

    Обработва се локално на устройството ви ...

    0%

    Качва ли се файлът ми?

    Не. Всичко работи в браузъра ви - файлът ви никога не напуска устройството. Как се проверява това

    Без качване100% локално
    Съдържанието остава у теббез достъп на трети страни
    Hosted in GermanyGlobal Content Delivery
    Независимо провереноTLS A+ · Заглавки A+

    Редът се възстановява страница по страница: части от текста на еднаква височина образуват ред, четен отгоре надолу и отляво надясно. Страниците се разделят с празен ред, така че резултатът лесно се обработва по-нататък, импортира или претърсва.

    Технически данни

    Технически данни
    Входни форматиPDF
    Автоматично конвертиранеPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    Изходен форматTXT
    Пакетна обработкаНе
    ОбработкаЛокално в браузъра (JavaScript)
    Качване на файловеНяма

    В 3 стъпки

    1. Пуснете вашия PDF.
    2. Текстът се извлича автоматично.
    3. Изтеглете текста като .txt.

    Ограничения: Извлича съществуващия текстов слой на PDF и го връща като .txt файл в UTF-8; редовете се възстановяват от позициите на текста. Сканираните или чисто графичните PDF нямат текстов слой, там изходът остава празен: използвайте тогава PDF OCR. Шрифтовете, изображенията, цветовете и точното оформление (страници с няколко колони, таблици) се губят или само линейно се приближават. Защитените с парола PDF първо отворете със Заключване на PDF.

    Чести въпроси

    Защо текстовият ми файл е празен?

    Вероятно вашият PDF е сканиран или е съставен от изображения и няма текстов слой. Използвайте тогава PDF OCR, който разпознава текста от пикселите.

    Запазва ли се оформлението?

    Не. Получавате чист текст в реда на четене. Шрифтовете, изображенията, колоните и таблиците не се възпроизвеждат точно.

    В какво кодиране е файлът?

    В UTF-8, така че кирилицата и специалните знаци се запазват правилно.

    Как се разделят няколко страници?

    С празен ред между страниците.

    Качва ли се PDF?

    Не, извличането на текст се извършва изцяло локално в браузъра.

    Сходни инструменти

    PDF OCR - търсене · PDF към Word · Извлечи страници от PDF · PDF към Markdown · DOCX към HTML · DOCX към Markdown