Es entsteht keine Auftragsverarbeitung deiner Datei-Inhalte. Du brauchst keinen AVV mit gottrix, um vertrauliche oder geschäftliche Dokumente zu verarbeiten.
Hosted in GermanyGlobal Content Delivery
Origin-Server bei Hetzner in Deutschland, weltweite Auslieferung über ein Content-Delivery-Netz. Deine Dateiinhalte werden dabei nie übertragen - sie verlassen dein Gerät nicht.
Markdown ist das Format für Notizen, Wikis, statische Webseiten und KI-Werkzeuge: schlicht, versionierbar und überall lesbar. Wer den Inhalt eines PDF dort weiterverwenden will, kopiert ihn bisher mühsam zusammen. Dieses Werkzeug liest die Textebene des PDF aus und gibt sie als Markdown zurück, bei dem die Grobstruktur bereits gesetzt ist - Überschriften, Aufzählungen und Absätze statt einer einzigen Textwand.
Die Struktur wird über eine Heuristik erkannt: Zeilen mit deutlich größerer Schrift als der Fließtext werden zu Überschriften (#, ## oder ###), Zeilen mit einem Aufzählungs- oder Nummernzeichen werden zu Markdown-Listen, und ein größerer senkrechter Abstand zwischen Zeilen markiert einen neuen Absatz. So entsteht aus den reinen Textpositionen ein lesbares, weiterverwendbares Markdown-Dokument - ideal als Ausgangspunkt, das du in deinem Editor noch verfeinerst.
Ehrlich und wichtig: Das ist eine Struktur-Annäherung, keine originalgetreue Layout-Rekonstruktion. Tabellen, mehrspaltige Seiten und feine Formatierungen lassen sich aus der Textebene nicht verlustfrei ableiten. Wie beim reinen Textextrakt gilt: Ein eingescanntes oder reines Bild-PDF hat keine Textebene - dort bleibt das Ergebnis leer, und du brauchst stattdessen die Texterkennung „PDF OCR". Alles läuft lokal im Browser via pdf.js; deine Datei verlässt dein Gerät nicht.
Grenzen: Wandelt die vorhandene Textebene eines PDF in Markdown um (UTF-8 .md). Überschriften, Listen und Absätze werden heuristisch aus Schriftgröße und Abständen erkannt - das ist eine Struktur-Annäherung, keine exakte Layout-Rekonstruktion. Tabellen und mehrspaltige Seiten werden nur linear angenähert. Nur der Text wird gelesen (pdf.js getTextContent) - eingebettete Bilder werden nicht ins Markdown übernommen. Eingescannte oder reine Bild-PDFs haben keine Textebene; dort bleibt das Ergebnis leer, nutze dann "PDF OCR". Passwortgeschützte PDFs zuerst entsperren.
Häufige Fragen
Wie werden Überschriften erkannt?
Anhand der Schriftgröße: Zeilen, die deutlich größer als der Fließtext sind, werden je nach Verhältnis zu #, ## oder ### umgesetzt.
Bleiben Tabellen und Spalten erhalten?
Nein. Die Umwandlung ist eine Struktur-Annäherung; Tabellen und mehrspaltige Layouts werden nur linear angenähert, nicht originalgetreu nachgebaut.
Warum ist mein Markdown leer?
Wahrscheinlich ist dein PDF ein Scan oder besteht aus Bildern und hat keine Textebene. Nutze dann "PDF OCR", das Text aus den Pixeln erkennt.
Wird die PDF hochgeladen?
Nein. Die Umwandlung läuft vollständig lokal im Browser via pdf.js; die Datei verlässt dein Gerät nicht.
Nur mit deiner Zustimmung messen wir mit Cookies anonymisiert die Nutzung, um gottrix zu verbessern. Deine Dateien bleiben immer lokal auf deinem Gerät. Datenschutz