hi

PDF से Markdown

PDF की टेक्स्ट परत को स्थानीय रूप से Markdown में बदलें - शीर्षक, सूचियाँ और पैराग्राफ दस्तावेज़ की संरचना से पहचाने जाते हैं। कोई अपलोड नहीं।

आपके डिवाइस पर ही स्थानीय प्रोसेसिंग चल रही है ...

आपकी फ़ाइलें

    आपके डिवाइस पर ही स्थानीय प्रोसेसिंग चल रही है ...

    0%

    आपकी फ़ाइलें आपके डिवाइस से कभी बाहर नहीं गईं

      इस फ़ाइल के साथ जारी रखें

      दोबारा अपलोड नहीं

      ये टूल .MD स्वीकार करते हैं - आपकी फ़ाइल सीधे भेज दी जाती है।

      क्या मेरी फ़ाइल अपलोड होती है?

      नहीं। सब कुछ आपके ब्राउज़र में चलता है - आपकी फ़ाइल कभी आपके डिवाइस से बाहर नहीं जाती। यह कैसे सत्यापित किया जा सकता है

      कोई अपलोड नहीं100% स्थानीय
      सामग्री आपके पास रहती हैकिसी तीसरे की पहुँच नहीं
      Hosted in GermanyGlobal Content Delivery
      स्वतंत्र रूप से जाँचा गयाTLS A+ · हेडर A+

      Markdown नोट्स, विकी, स्थिर वेबसाइटों और AI टूल के लिए पसंदीदा प्रारूप है: सरल, संस्करण-योग्य और हर जगह पठनीय। अब तक PDF की सामग्री को फिर से उपयोग करने के लिए उसे थकाऊ तरीके से मैन्युअल रूप से कॉपी करना पड़ता था। यह टूल PDF की टेक्स्ट परत पढ़ता है और उसे Markdown के रूप में लौटाता है जिसमें मोटी संरचना पहले से तय होती है - शीर्षक, बुलेट सूचियाँ और पैराग्राफ, बजाय एक अखंड टेक्स्ट दीवार के।

      संरचना एक heuristic से पहचानी जाती है: मुख्य टेक्स्ट से काफी बड़े फ़ॉन्ट वाली पंक्तियाँ शीर्षक बन जाती हैं (#, ## या ###), बुलेट या नंबर से शुरू होने वाली पंक्तियाँ Markdown सूचियाँ बनती हैं, और पंक्तियों के बीच बड़ा ऊर्ध्वाधर अंतर नया पैराग्राफ दर्शाता है। इस तरह कच्चे टेक्स्ट से एक पठनीय, पुनः उपयोग योग्य Markdown दस्तावेज़ तैयार होता है - जो आपके एडिटर में और निखारने के लिए एक आदर्श शुरुआती बिंदु है।

      ईमानदारी से और महत्वपूर्ण: यह संरचना का अनुमान है, न कि मूल लेआउट की सटीक पुनर्रचना। टेबल, बहु-स्तंभ पृष्ठ और सूक्ष्म फ़ॉर्मेटिंग को टेक्स्ट परत से बिना नुकसान के नहीं निकाला जा सकता। सरल टेक्स्ट निष्कर्षण की तरह: स्कैन किया गया या केवल छवि वाला PDF में टेक्स्ट परत नहीं होती - वहाँ परिणाम खाली रहता है और आपको PDF OCR का उपयोग करना होगा। सब कुछ pdf.js के जरिए ब्राउज़र में स्थानीय रूप से चलता है; आपकी फ़ाइल आपके डिवाइस को नहीं छोड़ती।

      तकनीकी विवरण

      तकनीकी विवरण
      इनपुट फ़ॉर्मैटPDF
      स्वचालित रूपांतरणPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
      आउटपुट फ़ॉर्मैटMD
      बैच प्रोसेसिंगनहीं
      प्रोसेसिंगब्राउज़र में स्थानीय रूप से (JavaScript)
      फ़ाइल अपलोडकोई नहीं

      3 चरणों में

      1. PDF यहाँ छोड़ें।
      2. संरचना स्वचालित रूप से पहचानी जाती है।
      3. Markdown को .md फ़ाइल के रूप में डाउनलोड करें।

      सीमाएँ: PDF की मौजूदा टेक्स्ट परत को Markdown (UTF-8 .md) में बदलता है। शीर्षक, सूचियाँ और पैराग्राफ फ़ॉन्ट आकार और अंतराल से heuristic रूप से पहचाने जाते हैं - यह संरचना का अनुमान है, सटीक लेआउट पुनर्रचना नहीं। टेबल और बहु-स्तंभ पृष्ठ केवल रैखिक रूप से अनुमानित किए जाते हैं। स्कैन किए गए या केवल छवि वाले PDF में टेक्स्ट परत नहीं होती; परिणाम खाली रहेगा, PDF OCR का उपयोग करें। पासवर्ड से सुरक्षित PDF पहले अनलॉक करें। केवल टेक्स्ट पढ़ा जाता है (pdf.js का getTextContent); एम्बेड की गई तस्वीरें Markdown में शामिल नहीं की जातीं।

      अक्सर पूछे जाने वाले प्रश्न

      शीर्षक कैसे पहचाने जाते हैं?

      फ़ॉन्ट आकार से: मुख्य टेक्स्ट से काफी बड़ी पंक्तियाँ अनुपात के अनुसार #, ## या ### में बदलती हैं।

      क्या टेबल और कॉलम सुरक्षित रहते हैं?

      नहीं। यह रूपांतरण संरचना का अनुमान है; टेबल और बहु-स्तंभ लेआउट केवल रैखिक रूप से अनुमानित किए जाते हैं, मूल रूप से पुनर्निर्मित नहीं।

      मेरा Markdown खाली क्यों है?

      संभवतः आपका PDF स्कैन किया गया है या केवल छवियों से बना है और उसमें टेक्स्ट परत नहीं है। PDF OCR उपयोग करें जो पिक्सेल से टेक्स्ट पहचानता है।

      क्या PDF सर्वर पर अपलोड होता है?

      नहीं। रूपांतरण पूरी तरह से pdf.js के जरिए ब्राउज़र में स्थानीय रूप से होता है; फ़ाइल आपके डिवाइस को नहीं छोड़ती।

      संबंधित टूल

      PDF से टेक्स्ट · PDF OCR (खोजने योग्य) · HTML से Markdown · Markdown से PDF बनाएं · PDF से तालिका निकालें · PDF से Word