किसी सर्वर पर आपकी फ़ाइल की सामग्री की कोई प्रोसेसिंग नहीं होती। गोपनीय या व्यावसायिक दस्तावेज़ संभालने के लिए आपको gottrix के साथ किसी डेटा-प्रोसेसिंग समझौते की ज़रूरत नहीं।
Hosted in GermanyGlobal Content Delivery
ओरिजिन सर्वर जर्मनी में Hetzner पर हैं, और कंटेंट डिलीवरी नेटवर्क (CDN) के ज़रिए दुनिया भर में डिलीवरी होती है। इस दौरान आपकी फ़ाइल की सामग्री कभी ट्रांसमिट नहीं होती - वह आपके डिवाइस से बाहर नहीं जाती।
Markdown नोट्स, विकी, स्थिर वेबसाइटों और AI टूल के लिए पसंदीदा प्रारूप है: सरल, संस्करण-योग्य और हर जगह पठनीय। अब तक PDF की सामग्री को फिर से उपयोग करने के लिए उसे थकाऊ तरीके से मैन्युअल रूप से कॉपी करना पड़ता था। यह टूल PDF की टेक्स्ट परत पढ़ता है और उसे Markdown के रूप में लौटाता है जिसमें मोटी संरचना पहले से तय होती है - शीर्षक, बुलेट सूचियाँ और पैराग्राफ, बजाय एक अखंड टेक्स्ट दीवार के।
संरचना एक heuristic से पहचानी जाती है: मुख्य टेक्स्ट से काफी बड़े फ़ॉन्ट वाली पंक्तियाँ शीर्षक बन जाती हैं (#, ## या ###), बुलेट या नंबर से शुरू होने वाली पंक्तियाँ Markdown सूचियाँ बनती हैं, और पंक्तियों के बीच बड़ा ऊर्ध्वाधर अंतर नया पैराग्राफ दर्शाता है। इस तरह कच्चे टेक्स्ट से एक पठनीय, पुनः उपयोग योग्य Markdown दस्तावेज़ तैयार होता है - जो आपके एडिटर में और निखारने के लिए एक आदर्श शुरुआती बिंदु है।
ईमानदारी से और महत्वपूर्ण: यह संरचना का अनुमान है, न कि मूल लेआउट की सटीक पुनर्रचना। टेबल, बहु-स्तंभ पृष्ठ और सूक्ष्म फ़ॉर्मेटिंग को टेक्स्ट परत से बिना नुकसान के नहीं निकाला जा सकता। सरल टेक्स्ट निष्कर्षण की तरह: स्कैन किया गया या केवल छवि वाला PDF में टेक्स्ट परत नहीं होती - वहाँ परिणाम खाली रहता है और आपको PDF OCR का उपयोग करना होगा। सब कुछ pdf.js के जरिए ब्राउज़र में स्थानीय रूप से चलता है; आपकी फ़ाइल आपके डिवाइस को नहीं छोड़ती।
सीमाएँ: PDF की मौजूदा टेक्स्ट परत को Markdown (UTF-8 .md) में बदलता है। शीर्षक, सूचियाँ और पैराग्राफ फ़ॉन्ट आकार और अंतराल से heuristic रूप से पहचाने जाते हैं - यह संरचना का अनुमान है, सटीक लेआउट पुनर्रचना नहीं। टेबल और बहु-स्तंभ पृष्ठ केवल रैखिक रूप से अनुमानित किए जाते हैं। स्कैन किए गए या केवल छवि वाले PDF में टेक्स्ट परत नहीं होती; परिणाम खाली रहेगा, PDF OCR का उपयोग करें। पासवर्ड से सुरक्षित PDF पहले अनलॉक करें। केवल टेक्स्ट पढ़ा जाता है (pdf.js का getTextContent); एम्बेड की गई तस्वीरें Markdown में शामिल नहीं की जातीं।
अक्सर पूछे जाने वाले प्रश्न
शीर्षक कैसे पहचाने जाते हैं?
फ़ॉन्ट आकार से: मुख्य टेक्स्ट से काफी बड़ी पंक्तियाँ अनुपात के अनुसार #, ## या ### में बदलती हैं।
क्या टेबल और कॉलम सुरक्षित रहते हैं?
नहीं। यह रूपांतरण संरचना का अनुमान है; टेबल और बहु-स्तंभ लेआउट केवल रैखिक रूप से अनुमानित किए जाते हैं, मूल रूप से पुनर्निर्मित नहीं।
मेरा Markdown खाली क्यों है?
संभवतः आपका PDF स्कैन किया गया है या केवल छवियों से बना है और उसमें टेक्स्ट परत नहीं है। PDF OCR उपयोग करें जो पिक्सेल से टेक्स्ट पहचानता है।
क्या PDF सर्वर पर अपलोड होता है?
नहीं। रूपांतरण पूरी तरह से pdf.js के जरिए ब्राउज़र में स्थानीय रूप से होता है; फ़ाइल आपके डिवाइस को नहीं छोड़ती।
केवल आपकी सहमति से ही हम gottrix को बेहतर बनाने के लिए कुकीज़ के ज़रिए उपयोग को गुमनाम रूप से मापते हैं। आपकी फ़ाइलें हमेशा आपके डिवाइस पर ही स्थानीय रहती हैं। गोपनीयता