hi

PDF से टेक्स्ट

किसी PDF की टेक्स्ट परत को एक सादे .txt फ़ाइल के रूप में निकालें - कॉपी, पुन: उपयोग या खोज के लिए। डिवाइस पर ही, कोई अपलोड नहीं।

आपके डिवाइस पर ही स्थानीय प्रोसेसिंग चल रही है ...

आपकी फ़ाइलें

    आपके डिवाइस पर ही स्थानीय प्रोसेसिंग चल रही है ...

    0%

    आपकी फ़ाइलें आपके डिवाइस से कभी बाहर नहीं गईं

      क्या मेरी फ़ाइल अपलोड होती है?

      नहीं। सब कुछ आपके ब्राउज़र में चलता है - आपकी फ़ाइल कभी आपके डिवाइस से बाहर नहीं जाती। यह कैसे सत्यापित किया जा सकता है

      कोई अपलोड नहीं100% स्थानीय
      सामग्री आपके पास रहती हैकिसी तीसरे की पहुँच नहीं
      Hosted in GermanyGlobal Content Delivery
      स्वतंत्र रूप से जाँचा गयाTLS A+ · हेडर A+

      क्रम को पेज-दर-पेज फिर से बनाया जाता है: एक ही ऊँचाई पर मौजूद टेक्स्ट के हिस्से मिलकर एक लाइन बनाते हैं, जिसे ऊपर से नीचे और बाएँ से दाएँ पढ़ा जाता है। पेजों को एक खाली लाइन से अलग किया जाता है, जिससे नतीजे को आगे इस्तेमाल करना, इम्पोर्ट करना या खोजना आसान हो जाता है।

      तकनीकी विवरण

      तकनीकी विवरण
      इनपुट फ़ॉर्मैटPDF
      स्वचालित रूपांतरणPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
      आउटपुट फ़ॉर्मैटTXT
      बैच प्रोसेसिंगनहीं
      प्रोसेसिंगब्राउज़र में स्थानीय रूप से (JavaScript)
      फ़ाइल अपलोडकोई नहीं

      3 चरणों में

      1. अपनी PDF छोड़ें।
      2. टेक्स्ट अपने आप निकाला जाता है।
      3. टेक्स्ट को .txt के रूप में डाउनलोड करें।

      सीमाएँ: किसी PDF की मौजूदा टेक्स्ट परत निकालता है और उसे UTF-8 .txt फ़ाइल के रूप में लौटाता है; पंक्तियाँ टेक्स्ट की स्थितियों से पुनर्निर्मित होती हैं। स्कैन की हुई या केवल छवि वाली PDF में टेक्स्ट परत नहीं होती, वहाँ आउटपुट खाली रहता है: तब PDF OCR का उपयोग करें। फ़ॉन्ट, चित्र, रंग और सटीक लेआउट (कई कॉलम वाले पृष्ठ, तालिकाएँ) खो जाते हैं या केवल रेखीय रूप से अनुमानित होते हैं। पासवर्ड वाली PDF पहले PDF अनलॉक करें से खोलें।

      अक्सर पूछे जाने वाले प्रश्न

      मेरी टेक्स्ट फ़ाइल खाली क्यों है?

      संभवतः आपकी PDF एक स्कैन है या छवियों से बनी है और उसमें टेक्स्ट परत नहीं है। तब PDF OCR का उपयोग करें, जो पिक्सेल से टेक्स्ट पहचानता है।

      क्या लेआउट बना रहता है?

      नहीं। आपको पढ़ने के क्रम में शुद्ध टेक्स्ट मिलता है। फ़ॉन्ट, चित्र, कॉलम और तालिकाएँ हूबहू प्रस्तुत नहीं होतीं।

      फ़ाइल किस एन्कोडिंग में है?

      UTF-8 में, ताकि हिंदी अक्षर और विशेष चिह्न भी सही बने रहें।

      कई पृष्ठ कैसे अलग किए जाते हैं?

      पेजों के बीच एक खाली लाइन डालकर।

      क्या PDF अपलोड होती है?

      नहीं, टेक्स्ट निकालना पूरी तरह ब्राउज़र में स्थानीय रूप से होता है।

      संबंधित टूल

      PDF OCR (खोजने योग्य) · PDF से Word · PDF पृष्ठ निकालें · PDF से Markdown · DOCX से HTML · DOCX से Markdown