de

PDF OCR durchsuchbar

Mach ein gescanntes PDF per OCR durchsuchbar - lokal im Browser, mit unsichtbarer Textebene unter den Originalseiten, ganz ohne Upload.

Läuft lokal auf deinem Gerät ...

Ausgabe
  • Durchsuchbares PDF
  • Nur Text (TXT)
Sprache des Dokuments
  • Deutsch
  • English
  • Français
  • Español
  • Italiano
  • Português
  • Nederlands
  • Polski
  • Русский
  • Українська
  • Čeština
  • Slovenčina
  • Română
  • Magyar
  • Ελληνικά
  • Türkçe
  • Svenska
  • Dansk
  • Norsk
  • Suomi
  • Català
  • Hrvatski
  • Српски
  • Български
  • العربية
  • עברית
  • فارسی
  • اردو
  • हिन्दी
  • বাংলা
  • 日本語
  • 한국어
  • 简体中文
  • 繁體中文
  • ไทย
  • Tiếng Việt
  • Bahasa Indonesia
  • Bahasa Melayu
  • Afrikaans
  • አማርኛ
  • অসমীয়া
  • Azərbaycanca
  • Азәрбајҹанҹа (Кирил)
  • Беларуская
  • བོད་སྐད་
  • Bosanski
  • Brezhoneg
  • Cebuano
  • ᏣᎳᎩ
  • Corsu
  • Cymraeg
  • ދިވެހި
  • རྫོང་ཁ
  • Esperanto
  • Eesti
  • Euskara
  • Føroyskt
  • Filipino
  • Frysk
  • Gàidhlig
  • Gaeilge
  • Galego
  • Ἀρχαία Ἑλληνικά
  • ગુજરાતી
  • Kreyòl ayisyen
  • Հայերեն
  • ᐃᓄᒃᑎᑐᑦ
  • Íslenska
  • Basa Jawa
  • ಕನ್ನಡ
  • ქართული
  • Қазақша
  • ខ្មែរ
  • Кыргызча
  • Kurmancî
  • ລາວ
  • Latina
  • Latviešu
  • Lietuvių
  • Lëtzebuergesch
  • മലയാളം
  • मराठी
  • Македонски
  • Malti
  • Монгол
  • Māori
  • မြန်မာ
  • नेपाली
  • Occitan
  • ଓଡ଼ିଆ
  • ਪੰਜਾਬੀ
  • پښتو
  • Runa Simi
  • संस्कृतम्
  • සිංහල
  • Slovenščina
  • سنڌي
  • Shqip
  • Srpski (latinica)
  • Basa Sunda
  • Kiswahili
  • ܠܫܢܐ ܣܘܪܝܝܐ
  • தமிழ்
  • Татарча
  • తెలుగు
  • Тоҷикӣ
  • ትግርኛ
  • Lea faka-Tonga
  • ئۇيغۇرچە
  • Oʻzbekcha
  • Ўзбекча (Кирил)
  • ייִדיש
  • Yorùbá

Deine Dateien

    Läuft lokal auf deinem Gerät ...

    0%

    Wird meine Datei hochgeladen?

    Nein. Die Umwandlung läuft komplett in Deinem Browser - Deine Datei verlässt Dein Gerät nie. So ist das nachprüfbar

    Kein Upload100% lokal
    Inhalte bleiben bei dirkein Zugriff durch Dritte
    Hosted in GermanyGlobal Content Delivery
    Extern geprüftTLS A+ · Header A+

    Ein gescanntes PDF ist im Grunde ein Stapel Bilder: Du siehst den Text, aber du kannst ihn nicht markieren, durchsuchen oder kopieren. OCR (optische Zeichenerkennung) liest die Buchstaben aus dem Bild und legt sie als unsichtbare Textebene exakt über die Seiten. Das Aussehen bleibt identisch, doch das PDF wird durchsuchbar und der Text lässt sich markieren - genau das, was Behörden, Archive und die Volltextsuche erwarten.

    Wähle als Ausgabe ein durchsuchbares PDF (Originalseiten plus Textebene) oder reinen Text als TXT. Stell die Sprache des Dokuments aus der Liste ein - 113 Sprachen von Deutsch und Englisch über Russisch, Arabisch und Hindi bis Japanisch, Koreanisch und Chinesisch, jede in ihrem eigenen Namen -, damit die Schriftzeichen richtig erkannt werden. Alles läuft im Browser per WebAssembly: dieselbe quelloffene Tesseract-Engine wie beim Werkzeug "Bild zu Text", nur seitenweise auf das ganze PDF angewendet. Beim ersten Gebrauch lädt der Browser Engine und das gewählte Sprachmodell einmalig nach (wenige MB, same-origin); danach geht es offline.

    Das Werkzeug ist für gescannte oder als Bild vorliegende PDFs gedacht. Die Erkennung hängt stark an der Scanqualität: scharfe, gerade, kontrastreiche Seiten mit gedrucktem Text werden sehr gut erkannt, schiefe oder unscharfe deutlich schlechter; Handschrift nicht zuverlässig. Im durchsuchbaren PDF wird jede Seite als Bild neu eingebettet - ein PDF, das bereits echten Text enthält, braucht daher kein OCR. Prüfe das Ergebnis bei Zahlen und Eigennamen kurz nach.

    Texterkennung ist sonst eine Domäne der Cloud: Bekannte OCR-Dienste laden jeden Scan zur Verarbeitung auf ihre Server - ausgerechnet Dokumente wie Verträge, Arztbriefe oder Ausweise. Hier läuft die komplette Erkennung mit Tesseract als WebAssembly in deinem Browser, und alle 113 Sprachpakete liegen selbst gehostet auf gottrix - beim Erkennen wird nichts von Drittanbietern nachgeladen. Die Sprachliste startet außerdem passend zu deiner Oberflächensprache vorausgewählt. Kostenlos, ohne Konto und ohne Seitenlimit.

    Technische Daten

    Technische Daten
    EingabeformatePDF
    Auto-KonvertierungPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, 7Z, DDS, HDR, PCX, WBMP
    AusgabeformatePDF, TXT
    StapelverarbeitungJa
    VerarbeitungLokal im Browser (WebAssembly)
    Datei-UploadKeiner

    In 3 Schritten

    1. Gescanntes PDF ablegen.
    2. Ausgabe (durchsuchbares PDF oder Text) und Sprache aus der Liste wählen.
    3. Durchsuchbares PDF bzw. TXT herunterladen.

    Grenzen: Für GESCANNTE / Bild-PDFs: macht sie per OCR durchsuchbar (unsichtbare Textebene) oder liefert reinen Text. Erkennt GEDRUCKTEN Text in 113 Sprachen und vielen Schriften; Handschrift nicht zuverlässig. Hinweis: Die unsichtbare Textebene im durchsuchbaren PDF umfasst das lateinische Alphabet mit allen Akzentbuchstaben (23 der 113 Sprachen, u. a. Polnisch, Tschechisch, Vietnamesisch, Türkisch), dazu Griechisch und Kyrillisch. Zeichen anderer Schriften (z. B. CJK, Arabisch, Hebräisch, Devanagari, Thai) werden dort bewusst weggelassen statt verfälscht; für diese Schriften liefert die Ausgabe "Nur Text (TXT)" den vollständig erkannten Text. Im durchsuchbaren PDF wird jede Seite als Bild neu eingebettet, das Layout bleibt also erhalten, die Datei kann aber größer werden; ein PDF mit bereits echtem Text braucht kein OCR. Die Erkennung ist nicht fehlerfrei - besonders Zahlen und Eigennamen prüfen. Engine + gewähltes Sprachmodell werden einmalig nachgeladen (wenige MB, same-origin), danach offline-fähig. Große PDFs brauchen je nach Seitenzahl und Gerät etwas Zeit und Speicher.

    Häufige Fragen

    Wird mein PDF hochgeladen?

    Nein. Rendern und Texterkennung laufen vollständig lokal im Browser (WebAssembly); das PDF verlässt dein Gerät nicht - gerade bei Verträgen und Behördenpost der entscheidende Vorteil.

    Was ist ein durchsuchbares PDF?

    Die Seite sieht aus wie der Scan, aber darunter liegt eine unsichtbare Textebene. Dadurch kannst du im PDF suchen, Text markieren und kopieren - der optische Eindruck bleibt gleich.

    Bleibt das Layout erhalten?

    Ja. Jede Seite wird als Bild der Originalseite eingebettet, die unsichtbare Textebene liegt passgenau darüber. Das Aussehen ändert sich nicht, die Datei kann aber etwas größer werden.

    Erkennt es Handschrift oder andere Sprachen?

    Andere Sprachen ja: über 100 stehen zur Wahl (auch Arabisch, Russisch, Hindi, Japanisch, Koreanisch, Chinesisch). Handschrift wird nicht zuverlässig erkannt, nur gedruckter Text. Die durchsuchbare PDF-Textebene deckt Lateinisch mit allen Akzentbuchstaben, Griechisch und Kyrillisch ab; bei CJK, Arabisch, Hebräisch, Devanagari oder Thai nutze die Ausgabe "Nur Text (TXT)", dort steht der vollständig erkannte Text.

    Wie viele Sprachen erkennt die Texterkennung?

    113 - von Deutsch, Englisch und Spanisch über Arabisch, Hindi und Thai bis Japanisch, Koreanisch und Chinesisch. Jede Sprache steht in ihrem eigenen Namen in der Liste, und alle Sprachpakete liegen auf gottrix selbst, nicht bei einem Drittanbieter.

    Ist PDF-OCR kostenlos, und gibt es ein Seitenlimit?

    Ja, vollständig kostenlos - ohne Konto, ohne Wasserzeichen und ohne Seiten- oder Tageslimit. Sehr viele Seiten brauchen nur entsprechend Zeit, weil dein eigenes Gerät die Erkennung rechnet.

    Warum ist lokale Texterkennung besser für vertrauliche Scans?

    Weil der Scan dein Gerät nie verlässt: kein Upload, keine Serververarbeitung, keine Kopie in einer fremden Cloud. Nach dem ersten Laden funktioniert die Erkennung sogar offline - der stärkste Beweis, dass nichts übertragen wird.

    Passende Tools

    Bild zu Text (OCR) · PDF zu Word · PDF komprimieren · PDF zu Markdown · PDF in Text · PDF zu EPUB