es

PDF OCR buscable

Convierte un PDF escaneado en buscable con OCR directamente en el navegador, con capa de texto invisible sobre las páginas originales, sin subir nada.

Procesando localmente en tu dispositivo ...

Salida
  • PDF buscable
  • Solo texto (TXT)
Idioma del documento
  • Deutsch
  • English
  • Français
  • Español
  • Italiano
  • Português
  • Nederlands
  • Polski
  • Русский
  • Українська
  • Čeština
  • Slovenčina
  • Română
  • Magyar
  • Ελληνικά
  • Türkçe
  • Svenska
  • Dansk
  • Norsk
  • Suomi
  • Català
  • Hrvatski
  • Српски
  • Български
  • العربية
  • עברית
  • فارسی
  • اردو
  • हिन्दी
  • বাংলা
  • 日本語
  • 한국어
  • 简体中文
  • 繁體中文
  • ไทย
  • Tiếng Việt
  • Bahasa Indonesia
  • Bahasa Melayu
  • Afrikaans
  • አማርኛ
  • অসমীয়া
  • Azərbaycanca
  • Азәрбајҹанҹа (Кирил)
  • Беларуская
  • བོད་སྐད་
  • Bosanski
  • Brezhoneg
  • Cebuano
  • ᏣᎳᎩ
  • Corsu
  • Cymraeg
  • ދިވެހި
  • རྫོང་ཁ
  • Esperanto
  • Eesti
  • Euskara
  • Føroyskt
  • Filipino
  • Frysk
  • Gàidhlig
  • Gaeilge
  • Galego
  • Ἀρχαία Ἑλληνικά
  • ગુજરાતી
  • Kreyòl ayisyen
  • Հայերեն
  • ᐃᓄᒃᑎᑐᑦ
  • Íslenska
  • Basa Jawa
  • ಕನ್ನಡ
  • ქართული
  • Қазақша
  • ខ្មែរ
  • Кыргызча
  • Kurmancî
  • ລາວ
  • Latina
  • Latviešu
  • Lietuvių
  • Lëtzebuergesch
  • മലയാളം
  • मराठी
  • Македонски
  • Malti
  • Монгол
  • Māori
  • မြန်မာ
  • नेपाली
  • Occitan
  • ଓଡ଼ିଆ
  • ਪੰਜਾਬੀ
  • پښتو
  • Runa Simi
  • संस्कृतम्
  • සිංහල
  • Slovenščina
  • سنڌي
  • Shqip
  • Srpski (latinica)
  • Basa Sunda
  • Kiswahili
  • ܠܫܢܐ ܣܘܪܝܝܐ
  • தமிழ்
  • Татарча
  • తెలుగు
  • Тоҷикӣ
  • ትግርኛ
  • Lea faka-Tonga
  • ئۇيغۇرچە
  • Oʻzbekcha
  • Ўзбекча (Кирил)
  • ייִדיש
  • Yorùbá

Tus archivos

    Procesando localmente en tu dispositivo ...

    0%

    ¿Se sube mi archivo?

    No. Todo se ejecuta en tu navegador: tu archivo nunca sale de tu dispositivo. Cómo se puede comprobar

    Sin subidas100% local
    Tus datos son tuyossin acceso de terceros
    Hosted in GermanyGlobal Content Delivery
    Auditoría externaTLS A+ · Cabeceras A+

    Un PDF escaneado es en esencia un conjunto de imágenes: ves el texto, pero no puedes seleccionarlo, buscarlo ni copiarlo. OCR (reconocimiento óptico de caracteres) lee las letras de la imagen y las coloca como una capa de texto invisible exactamente encima de las páginas. El aspecto no cambia, pero el PDF se vuelve buscable y el texto, seleccionable; justo lo que necesitan organismos oficiales, archivos y la búsqueda de texto completo.

    Elige como salida un PDF buscable (páginas originales más capa de texto) o texto plano como TXT. Selecciona el idioma del documento en la lista, 113 idiomas desde alemán, español e inglés hasta ruso, árabe e hindi, pasando por japonés, coreano y chino, cada uno con su propio nombre, para que los caracteres se reconozcan correctamente. Todo se ejecuta en el navegador mediante WebAssembly: el mismo motor Tesseract de código abierto que la herramienta "Imagen a texto", aplicado página a página sobre todo el PDF. En el primer uso, el navegador descarga el motor y el modelo de idioma elegido una sola vez (pocos MB, mismo origen); después funciona sin conexión.

    La herramienta está pensada para PDFs escaneados o compuestos solo de imágenes. El reconocimiento depende en gran medida de la calidad del escaneo: páginas nítidas, rectas y con buen contraste se reconocen muy bien; las torcidas o borrosas, bastante peor; la escritura a mano no se reconoce de forma fiable. En el PDF buscable cada página se incrusta de nuevo como imagen, por lo que el diseño se mantiene pero el archivo puede crecer algo. Un PDF que ya contiene texto real no necesita OCR. Revisa el resultado en números y nombres propios.

    El reconocimiento de texto suele ser terreno de la nube: los servicios de OCR conocidos suben cada escaneo a sus servidores para procesarlo - precisamente documentos como contratos, informes médicos o documentos de identidad. Aquí todo el reconocimiento se ejecuta con Tesseract como WebAssembly en tu navegador, y los 113 paquetes de idioma están alojados en el propio gottrix - durante el reconocimiento no se descarga nada de terceros. Además, la lista de idiomas arranca preseleccionada según el idioma de tu interfaz. Gratis, sin cuenta y sin límite de páginas.

    Ficha técnica

    Ficha técnica
    Formatos de entradaPDF
    Conversión automáticaPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    Formatos de salidaPDF, TXT
    Procesamiento por lotes
    ProcesamientoLocal en el navegador (WebAssembly)
    Subida de archivosNinguna

    En 3 pasos

    1. Añade el PDF escaneado.
    2. Elige la salida (PDF buscable o texto) y el idioma en la lista.
    3. Descarga el PDF buscable o el TXT.

    Límites: Para PDFs ESCANEADOS o de imágenes: los convierte en buscables con OCR (capa de texto invisible) o devuelve texto plano. Reconoce texto IMPRESO en 113 idiomas y muchos alfabetos; escritura a mano no de forma fiable. Nota: la capa de texto invisible del PDF buscable abarca el alfabeto latino con todas las letras acentuadas (23 de los 113 idiomas, p. ej. polaco, checo, vietnamita, turco), el griego y el cirílico. Los caracteres de otras escrituras (p. ej. CJK, árabe, hebreo, devanagari, tailandés) se omiten ahí deliberadamente en lugar de salir deformados; para esas escrituras, usa la salida "Solo texto (TXT)", que devuelve el texto reconocido completo. En el PDF buscable cada página se reincrusta como imagen, el diseño se conserva pero el archivo puede crecer; un PDF con texto real ya no necesita OCR. El reconocimiento no es perfecto: comprueba especialmente los números y los nombres propios. El motor y el modelo de idioma se descargan una sola vez (pocos MB, mismo origen), después funciona sin conexión. Los PDFs grandes pueden requerir más tiempo y memoria según el número de páginas y el dispositivo.

    Preguntas frecuentes

    ¿Se sube mi PDF a algún servidor?

    No. El renderizado y el reconocimiento se ejecutan completamente de forma local en el navegador (WebAssembly); el PDF no abandona nunca tu dispositivo, lo que es una ventaja decisiva especialmente para contratos y documentos oficiales.

    ¿Qué es un PDF buscable?

    La página tiene el aspecto del escaneo, pero debajo hay una capa de texto invisible. Así puedes buscar en el PDF, seleccionar y copiar texto sin que cambie la apariencia visual.

    ¿Se conserva el diseño?

    Sí. Cada página se incrusta como imagen de la página original con la capa de texto invisible colocada encima de forma precisa. El aspecto no cambia, aunque el archivo puede crecer algo.

    ¿Reconoce escritura a mano u otros idiomas?

    Otros idiomas sí: más de 100 disponibles, incluidos árabe, ruso, hindi, japonés, coreano y chino. La escritura a mano no se reconoce de forma fiable, solo el texto impreso. La capa de texto del PDF buscable abarca el latino con todas las letras acentuadas, el griego y el cirílico; para CJK, árabe, hebreo, devanagari o tailandés, usa la salida "Solo texto (TXT)", que contiene el texto reconocido completo.

    ¿Cuántos idiomas reconoce el OCR?

    113 - del español, inglés y alemán al árabe, hindi y tailandés, hasta japonés, coreano y chino. Cada idioma aparece con su propio nombre en la lista, y todos los paquetes de idioma están alojados en el propio gottrix, no en un tercero.

    ¿El OCR de PDF es gratis, y hay límite de páginas?

    Sí, totalmente gratis - sin cuenta, sin marca de agua y sin límite de páginas ni diario. Muchas páginas simplemente tardan proporcionalmente más, porque el reconocimiento lo calcula tu propio dispositivo.

    ¿Por qué el reconocimiento local es mejor para escaneos confidenciales?

    Porque el escaneo nunca sale de tu dispositivo: sin subida, sin procesamiento en servidor, sin copia en una nube ajena. Tras la primera carga, el reconocimiento funciona incluso sin conexión - la prueba más contundente de que no se transmite nada.

    Herramientas relacionadas

    Imagen a texto (OCR) · PDF a Word · Comprimir PDF · PDF a Markdown · PDF a texto · PDF a EPUB