ar

PDF OCR (قابل للبحث)

اجعل ملف PDF الممسوح قابلا للبحث عبر OCR - محليا في المتصفح، بطبقة نص مخفية أسفل الصفحات الأصلية، دون رفع الملف.

تتم المعالجة محلياً على جهازك ...

صيغة الإخراج
  • PDF قابل للبحث
  • نص فقط (TXT)
لغة المستند
  • Deutsch
  • English
  • Français
  • Español
  • Italiano
  • Português
  • Nederlands
  • Polski
  • Русский
  • Українська
  • Čeština
  • Slovenčina
  • Română
  • Magyar
  • Ελληνικά
  • Türkçe
  • Svenska
  • Dansk
  • Norsk
  • Suomi
  • Català
  • Hrvatski
  • Српски
  • Български
  • العربية
  • עברית
  • فارسی
  • اردو
  • हिन्दी
  • বাংলা
  • 日本語
  • 한국어
  • 简体中文
  • 繁體中文
  • ไทย
  • Tiếng Việt
  • Bahasa Indonesia
  • Bahasa Melayu
  • Afrikaans
  • አማርኛ
  • অসমীয়া
  • Azərbaycanca
  • Азәрбајҹанҹа (Кирил)
  • Беларуская
  • བོད་སྐད་
  • Bosanski
  • Brezhoneg
  • Cebuano
  • ᏣᎳᎩ
  • Corsu
  • Cymraeg
  • ދިވެހި
  • རྫོང་ཁ
  • Esperanto
  • Eesti
  • Euskara
  • Føroyskt
  • Filipino
  • Frysk
  • Gàidhlig
  • Gaeilge
  • Galego
  • Ἀρχαία Ἑλληνικά
  • ગુજરાતી
  • Kreyòl ayisyen
  • Հայերեն
  • ᐃᓄᒃᑎᑐᑦ
  • Íslenska
  • Basa Jawa
  • ಕನ್ನಡ
  • ქართული
  • Қазақша
  • ខ្មែរ
  • Кыргызча
  • Kurmancî
  • ລາວ
  • Latina
  • Latviešu
  • Lietuvių
  • Lëtzebuergesch
  • മലയാളം
  • मराठी
  • Македонски
  • Malti
  • Монгол
  • Māori
  • မြန်မာ
  • नेपाली
  • Occitan
  • ଓଡ଼ିଆ
  • ਪੰਜਾਬੀ
  • پښتو
  • Runa Simi
  • संस्कृतम्
  • සිංහල
  • Slovenščina
  • سنڌي
  • Shqip
  • Srpski (latinica)
  • Basa Sunda
  • Kiswahili
  • ܠܫܢܐ ܣܘܪܝܝܐ
  • தமிழ்
  • Татарча
  • తెలుగు
  • Тоҷикӣ
  • ትግርኛ
  • Lea faka-Tonga
  • ئۇيغۇرچە
  • Oʻzbekcha
  • Ўзбекча (Кирил)
  • ייִדיש
  • Yorùbá

ملفاتك

    تتم المعالجة محلياً على جهازك ...

    0%

    هل يُرفَع ملفي؟

    لا. كل شيء يجري في متصفحك - ملفك لا يغادر جهازك أبداً. كيف يكون ذلك قابلاً للتحقق

    دون رفعمحلي 100%
    محتواك يبقى لديكلا وصول لأطراف خارجية
    Hosted in GermanyGlobal Content Delivery
    مدقَّقة خارجيًاTLS A+ · ترويسات A+

    ملف PDF الممسوح ضوئيا هو في جوهره مجموعة صور: ترى النص لكن لا تستطيع تحديده أو البحث فيه أو نسخه. تقنية OCR (التعرف الضوئي على الأحرف) تقرأ الأحرف من الصورة وتضعها كطبقة نص مخفية تماما فوق الصفحات. يبقى المظهر متطابقا، لكن ملف PDF يصبح قابلا للبحث ويمكن تحديد نصه - وهو تحديدا ما تحتاجه المؤسسات والأرشيفات والبحث في النص الكامل.

    اختر صيغة الإخراج: ملف PDF قابل للبحث (الصفحات الأصلية مع طبقة النص) أو نص عادي بصيغة TXT. حدد لغة المستند من القائمة - 113 لغة من العربية والإنجليزية إلى الروسية والهندية واليابانية والكورية والصينية، كل منها باسمها الخاص - لضمان التعرف الصحيح على الأحرف. كل شيء يعمل في المتصفح عبر WebAssembly: محرك Tesseract مفتوح المصدر ذاته المستخدم في أداة "صورة إلى نص"، يُطبَّق صفحة بصفحة على كامل ملف PDF. في أول استخدام، يُنزّل المتصفح المحرك ونموذج اللغة مرة واحدة (بضعة MB، same-origin)؛ بعد ذلك يعمل بلا اتصال.

    هذه الأداة مخصصة لملفات PDF الممسوحة ضوئيا أو القائمة على الصور. تعتمد جودة التعرف كثيرا على جودة المسح: الصفحات الواضحة المستقيمة عالية التباين بنص مطبوع تُعرَّف بدقة عالية؛ المائلة أو الضبابية أسوأ بكثير؛ الخط اليدوي غير موثوق. في ملف PDF القابل للبحث، تُعاد تضمين كل صفحة كصورة - ملف PDF الذي يحتوي فعلا على نص حقيقي لا يحتاج إلى OCR. راجع النتيجة للأرقام والأسماء الخاصة.

    التعرف على النص عادة مملكة السحابة: خدمات OCR المعروفة ترفع كل مسح ضوئي إلى خوادمها للمعالجة - وهي بالذات مستندات كالعقود والتقارير الطبية وبطاقات الهوية. هنا يعمل التعرف بأكمله بمحرك Tesseract مجمّعا إلى WebAssembly في متصفحك، وكل حزم اللغات الـ113 مستضافة على gottrix نفسه - وأثناء التعرف لا يُحمَّل أي شيء من أطراف ثالثة. كما تبدأ قائمة اللغات محددة مسبقا وفق لغة واجهتك. مجانا، دون حساب، ودون حد للصفحات.

    البيانات التقنية

    البيانات التقنية
    صيغ الإدخالPDF
    تحويل تلقائيPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    صيغ الإخراجPDF, TXT
    معالجة دفعيةنعم
    المعالجةمحليًا في المتصفح (WebAssembly)
    رفع الملفاتلا يوجد

    في 3 خطوات

    1. أضف ملف PDF الممسوح ضوئيا.
    2. اختر صيغة الإخراج (PDF قابل للبحث أو نص) واللغة من القائمة.
    3. نزّل ملف PDF القابل للبحث أو TXT.

    القيود: لملفات PDF الممسوحة/القائمة على صور: تجعلها قابلة للبحث عبر OCR (طبقة نص مخفية) أو تُعيد نصا عاديا. تتعرف على النص المطبوع في 113 لغة وخطوط عديدة؛ الخط اليدوي غير موثوق. ملاحظة: تغطي طبقة النص المخفية في ملف PDF القابل للبحث الحروف اللاتينية بكل علاماتها التشكيلية (23 من أصل 113 لغة، مثل البولندية والتشيكية والفيتنامية والتركية) واليونانية والسيريلية. أما أحرف الكتابات الأخرى (مثل CJK والعربية والعبرية والديفاناغارية والتايلاندية) فتُحذف منها عمدا بدلا من أن تظهر مشوهة؛ لتلك الكتابات، يُعيد إخراج "نص فقط (TXT)" النص المُتعرَّف عليه كاملا. في ملف PDF القابل للبحث تُعاد تضمين كل صفحة كصورة فيُحفظ التخطيط لكن قد يكبر الملف؛ ملف PDF الذي يحتوي نصا حقيقيا لا يحتاج OCR. التعرف ليس خاليا من الأخطاء - راجع الأرقام والأسماء الخاصة بشكل خاص. يُنزَّل المحرك ونموذج اللغة مرة واحدة (بضعة MB، same-origin)، ثم يعمل بلا اتصال. الملفات الكبيرة تحتاج وقتا وذاكرة وفق عدد الصفحات والجهاز.

    الأسئلة الشائعة

    هل يُرفع ملف PDF إلى الخادم؟

    لا. يعمل التصيير والتعرف بالكامل محليا في المتصفح (WebAssembly)؛ لا يغادر ملف PDF جهازك أبدا - وهذا هو الفارق الحاسم للعقود والمراسلات الرسمية.

    ما هو ملف PDF القابل للبحث؟

    تبدو الصفحة كالمسح الضوئي، لكن تحتها طبقة نص مخفية. هذا يتيح البحث في ملف PDF وتحديد النص ونسخه - مع الحفاظ على المظهر البصري ذاته.

    هل يُحفظ التخطيط؟

    نعم. تُضمَّن كل صفحة كصورة للصفحة الأصلية مع طبقة النص المخفية فوقها بدقة. لا يتغير المظهر، وإن كان حجم الملف قد يزيد قليلا.

    هل يتعرف على الخط اليدوي أو لغات أخرى؟

    اللغات الأخرى نعم: أكثر من 100 متاحة (منها العربية والروسية والهندية واليابانية والكورية والصينية). الخط اليدوي لا يُتعرَّف عليه بموثوقية، فقط النص المطبوع. تغطي طبقة النص في ملف PDF القابل للبحث الحروف اللاتينية بكل علاماتها التشكيلية واليونانية والسيريلية؛ أما مع CJK أو العربية أو العبرية أو الديفاناغارية أو التايلاندية فاستخدم إخراج "نص فقط (TXT)" الذي يحتوي النص المُتعرَّف عليه كاملا.

    كم لغة يدعم التعرف على النص؟

    113 - من العربية والإنجليزية والألمانية مرورا بالهندية والتايلاندية وصولا إلى اليابانية والكورية والصينية. تظهر كل لغة في القائمة باسمها الخاص، وكل حزم اللغات مستضافة على gottrix نفسه، لا لدى طرف ثالث.

    هل OCR لملفات PDF مجاني، وهل هناك حد للصفحات؟

    نعم، مجاني بالكامل - دون حساب، دون علامة مائية، ودون حد للصفحات أو حد يومي. الصفحات الكثيرة تستغرق فقط وقتا أطول بالتناسب، لأن جهازك هو من يحسب التعرف.

    لماذا التعرف المحلي أفضل للمسوحات السرية؟

    لأن المسح لا يغادر جهازك أبدا: لا رفع، لا معالجة على خادم، لا نسخة في سحابة غريبة. بعد التحميل الأول يعمل التعرف حتى دون اتصال - أقوى دليل على أن شيئا لا يُرسل.

    أدوات ذات صلة

    صورة إلى نص (OCR) · PDF إلى Word · ضغط ملفات PDF · PDF إلى Markdown · PDF إلى نص · PDF إلى EPUB