de

PDF zu Markdown

Wandle die Textebene eines PDF lokal in Markdown um - Überschriften, Listen und Absätze werden anhand der Struktur erkannt. Kein Upload.

Läuft lokal auf deinem Gerät ...

Deine Dateien

    Läuft lokal auf deinem Gerät ...

    0%

    Wird meine Datei hochgeladen?

    Nein. Die Umwandlung läuft komplett in Deinem Browser - Deine Datei verlässt Dein Gerät nie. So ist das nachprüfbar

    Kein Upload100% lokal
    Inhalte bleiben bei dirkein Zugriff durch Dritte
    Hosted in GermanyGlobal Content Delivery
    Extern geprüftTLS A+ · Header A+

    Markdown ist das Format für Notizen, Wikis, statische Webseiten und KI-Werkzeuge: schlicht, versionierbar und überall lesbar. Wer den Inhalt eines PDF dort weiterverwenden will, kopiert ihn bisher mühsam zusammen. Dieses Werkzeug liest die Textebene des PDF aus und gibt sie als Markdown zurück, bei dem die Grobstruktur bereits gesetzt ist - Überschriften, Aufzählungen und Absätze statt einer einzigen Textwand.

    Die Struktur wird über eine Heuristik erkannt: Zeilen mit deutlich größerer Schrift als der Fließtext werden zu Überschriften (#, ## oder ###), Zeilen mit einem Aufzählungs- oder Nummernzeichen werden zu Markdown-Listen, und ein größerer senkrechter Abstand zwischen Zeilen markiert einen neuen Absatz. So entsteht aus den reinen Textpositionen ein lesbares, weiterverwendbares Markdown-Dokument - ideal als Ausgangspunkt, das du in deinem Editor noch verfeinerst.

    Ehrlich und wichtig: Das ist eine Struktur-Annäherung, keine originalgetreue Layout-Rekonstruktion. Tabellen, mehrspaltige Seiten und feine Formatierungen lassen sich aus der Textebene nicht verlustfrei ableiten. Wie beim reinen Textextrakt gilt: Ein eingescanntes oder reines Bild-PDF hat keine Textebene - dort bleibt das Ergebnis leer, und du brauchst stattdessen die Texterkennung „PDF OCR". Alles läuft lokal im Browser via pdf.js; deine Datei verlässt dein Gerät nicht.

    Technische Daten

    Technische Daten
    EingabeformatePDF
    Auto-KonvertierungPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, 7Z, DDS, HDR, PCX, WBMP
    AusgabeformatMD
    StapelverarbeitungNein
    VerarbeitungLokal im Browser (JavaScript)
    Datei-UploadKeiner

    In 3 Schritten

    1. PDF ablegen.
    2. Die Struktur wird automatisch erkannt.
    3. Markdown als .md herunterladen.

    Grenzen: Wandelt die vorhandene Textebene eines PDF in Markdown um (UTF-8 .md). Überschriften, Listen und Absätze werden heuristisch aus Schriftgröße und Abständen erkannt - das ist eine Struktur-Annäherung, keine exakte Layout-Rekonstruktion. Tabellen und mehrspaltige Seiten werden nur linear angenähert. Nur der Text wird gelesen (pdf.js getTextContent) - eingebettete Bilder werden nicht ins Markdown übernommen. Eingescannte oder reine Bild-PDFs haben keine Textebene; dort bleibt das Ergebnis leer, nutze dann "PDF OCR". Passwortgeschützte PDFs zuerst entsperren.

    Häufige Fragen

    Wie werden Überschriften erkannt?

    Anhand der Schriftgröße: Zeilen, die deutlich größer als der Fließtext sind, werden je nach Verhältnis zu #, ## oder ### umgesetzt.

    Bleiben Tabellen und Spalten erhalten?

    Nein. Die Umwandlung ist eine Struktur-Annäherung; Tabellen und mehrspaltige Layouts werden nur linear angenähert, nicht originalgetreu nachgebaut.

    Warum ist mein Markdown leer?

    Wahrscheinlich ist dein PDF ein Scan oder besteht aus Bildern und hat keine Textebene. Nutze dann "PDF OCR", das Text aus den Pixeln erkennt.

    Wird die PDF hochgeladen?

    Nein. Die Umwandlung läuft vollständig lokal im Browser via pdf.js; die Datei verlässt dein Gerät nicht.

    Passende Tools

    PDF in Text · PDF OCR durchsuchbar · HTML zu Markdown · Markdown zu PDF · PDF-Tabellen extrahieren · PDF zu Word