Er vindt geen verwerking van je bestandsinhoud op een server plaats. Je hebt geen verwerkersovereenkomst met gottrix nodig om vertrouwelijke of zakelijke documenten te bewerken.
Hosted in GermanyGlobal Content Delivery
Origin-servers bij Hetzner in Duitsland, wereldwijde levering via een content delivery network (CDN). De inhoud van je bestanden wordt daarbij nooit verzonden - die verlaat je apparaat niet.
OCR (optische tekenherkenning) zet de afbeelding van een tekst om in echte, selecteerbare tekst. Je fotografeert of scant een factuur, brief of boekpagina en krijgt de inhoud als TXT-bestand dat je kunt doorzoeken, kopiëren en verder verwerken. Het herkenningsmodel is de open-source Tesseract-engine, die hier volledig als WebAssembly in de browser draait - dezelfde aanpak als bij de andere tools.
Kies de taal van het document uit de lijst - meer dan 100 talen staan klaar, van Nederlands, Engels en de Europese talen tot Russisch, Arabisch, Hebreeuws en Hindi, en verder naar Japans, Koreaans en Chinees. Elke taal wordt in zijn eigen naam weergegeven, zodat je hem direct herkent. De juiste keuze zorgt ervoor dat letters, accenten en speciale tekens van dat schrift correct worden herkend. Bij eerste gebruik downloadt de browser eenmalig de herkenningsengine en het gekozen taalmodel van deze site (enkele megabytes, same-origin, geen externe server); daarna werkt de tool ook offline. Je kunt meerdere afbeeldingen tegelijk invoeren - elk wordt een eigen TXT.
De kwaliteit van de herkenning hangt bijna volledig af van de bron: een scherpe, rechte foto met veel contrast van gedrukte tekst wordt zeer goed herkend; een scheve, wazige of donkere afbeelding veel slechter. Gedrukt schrift werkt betrouwbaar, handschrift niet. Kolommen, tabellen en bijzondere lay-outs worden als doorlopende tekst weergegeven - de volgorde klopt meestal, maar de visuele structuur gaat verloren. Controleer het resultaat altijd kort, zeker bij cijfers.
Kies de documenttaal uit de lijst (meer dan 100 talen).
Download de herkende tekst als TXT.
Beperkingen: Herkent GEDRUKTE tekst uit heldere afbeeldingen (JPG, PNG, WebP, BMP) als TXT; handschrift wordt niet betrouwbaar herkend. Meer dan 100 talen en veel schriften (Latijn, Cyrillisch, Grieks, Arabisch, Hebreeuws, Indische schriften, CJK en meer) - kies het schrift dat bij je document past. Kolommen/tabellen/lay-out worden niet als structuur bewaard, alleen als doorlopende tekst. Herkenning is niet foutloos - controleer het resultaat, vooral cijfers en eigennamen. Bij eerste gebruik worden de engine plus het gekozen taalmodel eenmalig gedownload (enkele MB, same-origin); daarna offline bruikbaar. Voor gescande PDF's is er de aparte tool "PDF OCR" (doorzoekbaar of platte tekst).
Veelgestelde vragen
Wordt mijn afbeelding geüpload?
Nee. Tekstherkenning verloopt volledig lokaal in de browser (WebAssembly); de afbeelding verlaat je apparaat niet - juist bij gevoelige documenten het doorslaggevende voordeel.
Welke talen worden herkend?
Meer dan 100 talen en veel schriften - naast Nederlands en Engels ook Frans, Spaans, Russisch, Arabisch, Hebreeuws, Hindi, Japans, Koreaans, Chinees en meer. Kies de juiste taal uit de lijst zodat speciale tekens en letters correct worden herkend.
Werkt het ook met handschrift?
Nee, alleen met gedrukte tekst. De engine herkent handschrift niet betrouwbaar.
Waarom klopt de herkenning soms niet?
OCR hangt af van de beeldkwaliteit: scherp, recht en met veel contrast wordt heel goed herkend; scheef, wazig of donker veel slechter. Controleer cijfers en eigennamen altijd na.
Kan ik een gescande PDF laten herkennen?
Ja, daarvoor is de aparte tool "PDF OCR": die maakt een gescande PDF direct doorzoekbaar of levert platte tekst - zonder omweg via losse afbeeldingen.
Alleen met je toestemming meten we het gebruik geanonimiseerd via cookies om gottrix te verbeteren. Je bestanden blijven altijd lokaal, op jouw apparaat. Privacy