hi

PDF से Word

PDF को स्थानीय रूप से संपादन-योग्य Word दस्तावेज़ (DOCX) में बदलें: शीर्षक, सूचियाँ, बोल्ड/इटैलिक, तालिकाएँ और छवियाँ शामिल हैं। कोई अपलोड नहीं।

आपके डिवाइस पर ही स्थानीय प्रोसेसिंग चल रही है ...

आपकी फ़ाइलें

    आपके डिवाइस पर ही स्थानीय प्रोसेसिंग चल रही है ...

    0%

    आपकी फ़ाइलें आपके डिवाइस से कभी बाहर नहीं गईं

      इस फ़ाइल के साथ जारी रखें

      दोबारा अपलोड नहीं

      ये टूल .DOCX स्वीकार करते हैं - आपकी फ़ाइल सीधे भेज दी जाती है।

      क्या मेरी फ़ाइल अपलोड होती है?

      नहीं। सब कुछ आपके ब्राउज़र में चलता है - आपकी फ़ाइल कभी आपके डिवाइस से बाहर नहीं जाती। यह कैसे सत्यापित किया जा सकता है

      कोई अपलोड नहीं100% स्थानीय
      सामग्री आपके पास रहती हैकिसी तीसरे की पहुँच नहीं
      Hosted in GermanyGlobal Content Delivery
      स्वतंत्र रूप से जाँचा गयाTLS A+ · हेडर A+

      PDF एक बना-बनाया पृष्ठ-विन्यास है, संपादन-योग्य पाठ नहीं: अनुच्छेद ठीक से चुने नहीं जाते, वाक्य सहजता से दोबारा नहीं लिखे जाते और तालिका में आगे गणना नहीं की जा सकती। यह उपकरण आपकी PDF की वास्तविक संरचना पढ़ता है, यानी शीर्षक, अनुच्छेद, सूचियाँ, तालिकाएँ, पाद-टिप्पणियाँ और चित्र, और उसी से आपके अपने उपकरण पर Office Open XML स्वरूप की एक असली DOCX फ़ाइल बनाता है। वह फ़ाइल सीधे Word में, LibreOffice Writer में या किसी भी ऐसे कार्यक्रम में खुलती है जो .docx फ़ाइलें समझता हो। न जलचिह्न, न खाता, न रोज़ की कोई सीमा, क्योंकि रूपांतरण किसी सर्वर पर नहीं बल्कि ब्राउज़र के टैब में होता है।

      अनुच्छेद और अक्षर के स्तर पर मोटे और तिरछे अक्षरों से कहीं अधिक बचा रहता है। शीर्षक स्तर 1 से 6 तक के असली Word शीर्षक बनते हैं, रूपरेखा-स्तर के साथ, जिससे नेविगेशन फलक और स्वचालित विषय-सूची तुरंत काम करने लगते हैं। एक के भीतर एक रखी बिंदु-सूचियाँ अपने स्तर असली बहु-स्तरीय Word सूची के रूप में बनाए रखती हैं। रेखांकन और काट-रेखाएँ पृष्ठ पर वास्तव में खींची गई रेखाओं से पहचानी जाती हैं, ऊपरी और निचले अक्षर अपनी खिसकी हुई आधार-रेखा से, और रंगीन पाठ-उभार Word स्वरूप को ज्ञात 16 उभार-रंगों में से सबसे निकट वाले पर मढ़ दिया जाता है। PDF के संदर्भ क्लिक-योग्य Word हाइपरलिंक बन जाते हैं, और पृष्ठ के नीचे की टिप्पणियाँ पृष्ठ के अंत में बिखरे पाठ के बजाय पाद-टिप्पणी प्रबंधन में असली Word पाद-टिप्पणियों के रूप में पहुँचती हैं।

      तालिकाएँ तीन अलग-अलग रास्तों से पहचानी जाती हैं: वास्तव में खींची गई खाँचा-रेखाओं से, जहाँ स्तंभ-चौड़ाई उन्हीं रेखाओं की मापी गई स्थिति से आती है और साधारण जुड़ी हुई कोष्ठिकाएँ जुड़ी ही रहती हैं; स्तंभों के बीच स्पष्ट रूप से बार-बार लौटती खाली जगह से, जब तालिका में कोई रेखा हो ही न; और «क्षेत्र: मान» रूप की कम से कम तीन लगातार पंक्तियों की श्रृंखला से, जैसी प्रपत्र-PDF बनाती हैं। पृष्ठ का आकार, खड़ी या आड़ी दिशा, हाशिये और पाठ-स्तंभों की संख्या A4 की धारणा के बजाय पृष्ठ की वास्तविक ज्यामिति से ली जाती है; हर मूल पृष्ठ-सीमा पर एक साफ़ पृष्ठ-विराम रहता है; और चित्र अनुपात बनाए रखते हुए पठन-प्रवाह में अपनी जगह पर जड़े जाते हैं, यहाँ तक कि विशुद्ध सदिश रेखाओं से बने आरेख भी चित्र के रूप में पहचाने जाते हैं। बार-बार आने वाले शीर्ष-लेख और पाद-लेख बाएँ, मध्य और दाएँ टैब-बिंदुओं सहित असली Word शीर्ष-लेख और पाद-लेख बनते हैं; लगातार चलती पृष्ठ-संख्या जमी हुई अंक-संख्या के बजाय एक जीवंत Word फ़ील्ड बन जाती है, और बार-बार दिखने वाला जलचिह्न भी साथ आता है।

      लिपि-रूपों के मामले में यह उपकरण सीधा रास्ता चुनता है: स्रोत PDF में अंतर्निहित फ़ॉन्ट-प्रोग्राम स्वयं बिना किसी बदलाव के Word फ़ाइल में ले जाए जाते हैं, सामान्य, मोटे, तिरछे और मोटे-तिरछे रूप के लिए अलग-अलग। इसलिए मोटे में जमाए गए अनुच्छेद को अक्षर-अभिकल्प की असली रूपरेखा मिलती है, न कि शब्द-संसाधक द्वारा बाद में गिनी गई मोटाई। केवल वहीं, जहाँ PDF कोई फ़ॉन्ट लाती ही नहीं, एक मापों में संगत और खुली अनुज्ञप्ति वाला विकल्प-फ़ॉन्ट आता है, जो भी फ़ाइल में जड़ा जाता है, ताकि दस्तावेज़ ऐसे दूसरे कंप्यूटर पर भी सही दिखे जहाँ ये फ़ॉन्ट स्थापित न हों। रोमन वर्णमाला के बाहर के पाठ को इसके अलावा उपयुक्त लिपि और भाषा का चिह्नांकन मिलता है, ताकि Word चीनी, जापानी, कोरियाई, अरबी या हिब्रू को सही ढंग से गढ़े, जहाँ ज़रूरी हो वहाँ दाएँ से बाएँ जमाए, और वर्तनी-जाँच सही भाषा चुने।

      बहुत सारा काम उन PDF में लगा है जो ढर्रे से बाहर हैं। आड़ी सहेजी गई पृष्ठ अपनी ही पठन-दिशा में विश्लेषित होती है, ताकि उस पर की तालिका उलटी-पलटी न पहुँचे और शीर्षक अचानक खड़ा न हो जाए। ब्राउज़र से छापी गई PDF, उदाहरण के लिए Chrome या Edge के «PDF के रूप में छापें» से बनी, सूची के बिंदुओं को अक्षर के बजाय नन्हे सदिश वर्गों के रूप में खींचती हैं और तालिका की पूरी पंक्ति को एक ही पाठ-पंक्ति में चिपका देती हैं: दोनों ही ज्यामिति से पहचाने जाते हैं और फिर से असली सूचियों तथा अलग-अलग कोष्ठिकाओं में खोल दिए जाते हैं। पृष्ठ-संख्या शीर्ष-लेख या पाद-लेख तभी बनती है जब वह पृष्ठों के आर-पार सचमुच आगे गिनती रहे; एक बार आई ऐसी पंक्ति जो केवल पृष्ठ-संख्या जैसी दिखती है, पाठ में ही बनी रहती है, और «K-6» या «K-86» जैसे बदलते पृष्ठ-चिह्न किनारे की सजावट मानकर फेंके नहीं जाते।

      दो बातें यह उपकरण छिपाने के बजाय खुलकर बताता है। यदि स्रोत PDF में पाठ किसी अपारदर्शी काली पट्टी के पीछे था पर फिर भी पाठ की तरह पढ़ा जा सकता था, यानी ऊपर आयत पोतकर कालिख करने की वही पुरानी चूक, तो वह पाठ Word फ़ाइल में नहीं जाता और आपको बताया जाता है कि यह किन पृष्ठों पर हुआ। और यदि PDF के अक्षरों पर कोई Unicode मान है ही नहीं, जिसकी वजह से किसी भी PDF दर्शक से नक़ल करना भी विफल होता है, तो उनका अनुपात संख्या में बताया जाता है और आपको चुपचाप एक रिक्ति छोड़ने के बजाय «PDF OCR» की ओर भेजा जाता है। विश्लेषण और फ़ाइल का निर्माण पूरी तरह ब्राउज़र के टैब में होता है: आपकी PDF आपके उपकरण से बाहर नहीं जाती, और पहली बार लोड होने के बाद यह उपकरण बिना इंटरनेट के भी चलता है।

      तकनीकी विवरण

      तकनीकी विवरण
      इनपुट फ़ॉर्मैटPDF
      स्वचालित रूपांतरणPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
      आउटपुट फ़ॉर्मैटDOCX
      बैच प्रोसेसिंगनहीं
      प्रोसेसिंगब्राउज़र में स्थानीय रूप से (JavaScript)
      फ़ाइल अपलोडकोई नहीं

      3 चरणों में

      1. अपनी PDF छोड़ें: कुछ भी अपलोड नहीं होता।
      2. संरचना, तालिकाएँ, फ़ॉन्ट और चित्र स्थानीय रूप से पहचाने जाकर DOCX में ले जाए जाते हैं।
      3. DOCX डाउनलोड करें और Word या LibreOffice में आगे संपादित करें।

      सीमाएँ: यह संरचना का अंतरण है, PDF की बिंदु-दर-बिंदु नक़ल नहीं। जो ले जाया जाता है: रूपरेखा-स्तर सहित शीर्षक, अनुच्छेद, बहु-स्तरीय क्रमांकित और बिंदु-सूचियाँ, मोटा, तिरछा, रेखांकित, कटा हुआ, ऊपरी और निचले अक्षर, पाठ-उभार (Word के उभार-रंगों पर गोल किए हुए), क्लिक-योग्य हाइपरलिंक, असली पाद-टिप्पणियाँ, पठन-प्रवाह में चित्र और सदिश आरेख, जीवंत पृष्ठ-संख्या फ़ील्ड सहित असली शीर्ष-लेख और पाद-लेख, तथा वास्तविक ज्यामिति से लिया गया पृष्ठ-स्वरूप, दिशा, हाशिये और स्तंभ-संख्या। तालिकाएँ खाँचा-रेखाओं से, बार-बार लौटते स्तंभ-अंतराल से या «क्षेत्र: मान» रूप की पंक्तियों से पहचानी जाती हैं; फ़िलहाल प्रति पृष्ठ केवल एक सटा हुआ तालिका-क्षेत्र आँका जाता है, इसलिए एक ही पृष्ठ पर अलग-अलग खाँचों वाली कई तालिकाएँ एक के नीचे एक हों तो वे ग़लत ढंग से जोड़ी जाने के बजाय जानबूझकर सामान्य पाठ की तरह बहती हैं, और गहराई तक नत्थी या बहुत जुड़ी कोष्ठिकाओं वाली तालिकाएँ अब भी कमज़ोर हैं। हर कोष्ठिका में एक अनुच्छेद रहता है। और भी ईमानदार सीमाएँ: लगातार जमे हुए पाठ-खंड के भीतर का कोई रंगीन अंश अपना रंग खो देता है, और उसका केवल एक हिस्सा ढकने वाला उभार पूरे खंड को रंग देता है; PDF में लक्ष्य-पता दर्ज न होने पर संदर्भ छोड़ दिया जाता है; पाद-टिप्पणी के पाठ के भीतर का लिंक क्लिक-योग्य नहीं रहता; क्रमांकित सूची के भीतर रखी बिंदु-सूची अपने स्तर पर क्रमांक-चिह्न अपना लेती है (सामग्री और नत्थीकरण सही रहते हैं, केवल चिह्न नहीं); यदि शीर्ष-लेख हर अध्याय में बदलता है, तो वह प्रति-अध्याय अपना शीर्ष-लेख बनने के बजाय दस्तावेज़ में सामान्य पाठ के रूप में बना रहता है। चित्रों के चारों ओर पाठ बहाने वाले अत्यंत सज्जित पृष्ठ केवल लगभग ही बनते हैं, और जिन पृष्ठों पर कई हज़ार रेखा या सदिश तत्व हों वहाँ तालिका और आरेख की पहचान छोड़ दी जाती है। स्कैन की गई या केवल चित्रों वाली PDF में पाठ-परत होती ही नहीं: तब खाली परिणाम के बजाय «PDF OCR» की ओर संकेत दिखता है। पासवर्ड से सुरक्षित PDF पहले «PDF अनलॉक करें» से खोलें।

      अक्सर पूछे जाने वाले प्रश्न

      क्या PDF अपलोड होती है?

      नहीं। PDF ब्राउज़र के टैब में खुलती है, वहीं विश्लेषित होती है और Word फ़ाइल भी वहीं बनती है; ऐसा कोई सर्वर है ही नहीं जो कभी इस फ़ाइल को देखे। पहली बार आने के बाद यह उपकरण हवाई-जहाज़ मोड में भी चलता रहता है, और यही इस बात का सबसे सरल प्रमाण है कि कुछ भी अपलोड नहीं होता।

      क्या Word फ़ाइल बिल्कुल PDF जैसी दिखती है?

      नहीं, और यह जानबूझकर है। PDF एक जमा हुआ विन्यास है, Word दस्तावेज़ बहता हुआ पाठ: बिंदु-दर-बिंदु नक़ल Word में सार्थक ढंग से संपादित ही नहीं हो पाती। इसलिए अर्थ ले जाया जाता है: शीर्षक, अनुच्छेद, सूचियाँ, तालिकाएँ, पाद-टिप्पणियाँ, चित्र, शीर्ष-लेख और पाद-लेख, साथ ही पृष्ठ-स्वरूप और हाशिये। चित्रों के चारों ओर पाठ बहाने वाले अत्यंत सज्जित पृष्ठ केवल लगभग ही बनते हैं।

      क्या शीर्षक असली Word शीर्षक बने रहते हैं?

      हाँ। बड़ी और भारी जमाई गई पंक्तियाँ स्तर 1 से 6 तक के शीर्षक के रूप में पहचानी जाती हैं और उन्हें उपयुक्त रूपरेखा-स्तर मिलता है। इससे केवल शैलियाँ ही नहीं, बल्कि Word का नेविगेशन फलक और स्वतः बनी विषय-सूची भी तुरंत काम करने लगते हैं, और आपको स्वयं कुछ भी दोबारा सजाना नहीं पड़ता।

      क्या PDF का मूल फ़ॉन्ट बना रहता है?

      हाँ, बशर्ते PDF उसे साथ लाती हो। स्रोत PDF में अंतर्निहित फ़ॉन्ट-फ़ाइलें बिना बदलाव के Word फ़ाइल में ले जाई जाती हैं, सामान्य, मोटे, तिरछे और मोटे-तिरछे रूप के लिए अलग-अलग। जब PDF में कोई फ़ॉन्ट न हो, तभी मापों में संगत और खुली अनुज्ञप्ति वाला विकल्प आता है, जो भी जड़ा जाता है, ताकि दस्तावेज़ ऐसे कंप्यूटर पर भी सही दिखे जहाँ ये फ़ॉन्ट स्थापित न हों।

      क्या तालिकाएँ बनी रहती हैं?

      दिखाई देने वाली खाँचा-रेखाओं वाली तालिकाएँ असली Word तालिकाएँ बनती हैं, जिनकी स्तंभ-चौड़ाई मापी गई रेखा-स्थिति से आती है और साधारण जुड़ी कोष्ठिकाएँ ज्यों की त्यों रहती हैं। बिना खाँचे की वे तालिकाएँ भी पहचानी जाती हैं जिनका स्तंभ-अंतराल स्पष्ट रूप से बार-बार लौटता है, और «क्षेत्र: मान» रूप की प्रपत्र-पंक्तियाँ भी। फ़िलहाल प्रति पृष्ठ केवल एक सटा हुआ तालिका-क्षेत्र आँका जाता है: यदि अलग-अलग खाँचों वाली कई तालिकाएँ एक के नीचे एक हों, तो वे ग़लत जुड़ने के बजाय जानबूझकर सामान्य पाठ की तरह बहती हैं।

      क्या यह घुमाए हुए या आड़े पृष्ठों पर काम करता है?

      हाँ। PDF के भीतर घुमाई हुई अवस्था में सहेजी गई पृष्ठ दस्तावेज़ के बाक़ी हिस्से की नहीं, बल्कि अपनी ही पठन-दिशा में विश्लेषित होती है। इससे ऐसी पृष्ठ की तालिका अपनी पंक्तियाँ और स्तंभ सही दिशा में बनाए रखती है, और शीर्षक को ग़लती से खड़ा जमाया गया पाठ नहीं समझा जाता।

      क्या ब्राउज़र से छापी गई PDF की बिंदु-सूचियाँ पहचानी जाती हैं?

      हाँ। PDF के रूप में छापते समय Chrome और Edge सूची के बिंदुओं को अक्षर के बजाय नन्हे सदिश वर्गों के रूप में खींचते हैं, जिससे शुद्ध पाठ पढ़ने वाले के लिए सूची-चिह्न अदृश्य हो जाते हैं। यह उपकरण उन्हें उनके आकार से और इस बात से पहचानता है कि वे एक ही स्तंभ में सीध में खड़े हैं, और सूची को उसके सभी स्तरों सहित लौटा देता है। इसी स्रोत से चिपकी हुई तालिका-पंक्तियाँ भी फिर से अलग-अलग कोष्ठिकाओं में खुल जाती हैं।

      क्या चित्र, लिंक और पाद-टिप्पणियाँ ले जाई जाती हैं?

      हाँ, तीनों। अंतर्निहित चित्र पठन-प्रवाह में अपनी जगह पर जोड़े जाते हैं, चौड़ाई की सीमा और अनुपात को बनाए रखते हुए; विशुद्ध सदिश रेखाओं से बने आरेख भी चित्र के रूप में पहचाने जाते हैं। जिन संदर्भों का लक्ष्य दर्ज है वे क्लिक-योग्य Word हाइपरलिंक बनते हैं, और पृष्ठ के नीचे की टिप्पणियाँ असली Word पाद-टिप्पणियाँ। बिना लक्ष्य-पते वाला संदर्भ छोड़ दिया जाता है, और पाद-टिप्पणी के पाठ के भीतर का लिंक क्लिक-योग्य नहीं रहता।

      स्रोत PDF में काली पट्टी से ढके पाठ का क्या होता है?

      वह Word फ़ाइल में नहीं जाता। यदि कालिख करने के लिए पाठ को सचमुच हटाने के बजाय उस पर काला आयत पोत दिया गया हो, तो वह पाठ PDF के भीतर पूरी तरह पढ़ा जा सकता है, जो एक आम और भारी परिणाम वाली चूक है। यह उपकरण ऐसे पाठ को पहचान लेता है जो पूरी तरह किसी अपारदर्शी गहरे तल के पीछे हो, उसे बाहर रखता है और आपको बताता है कि यह किन पृष्ठों पर हुआ।

      स्कैन की गई PDF में क्या होता है?

      स्कैन चित्रों से बना होता है और उसमें पाठ-परत नहीं होती। यह उपकरण यह बात ईमानदारी से कहता है और खाली Word फ़ाइल बनाने के बजाय «PDF OCR» की ओर भेजता है। यदि किसी फ़ाइल में पाठ तो है पर उसके अक्षरों पर Unicode मान दर्ज नहीं है, तो प्रभावित अनुपात संख्या में बताया जाता है: तब किसी PDF दर्शक से नक़ल करना भी विफल होता है, और पाठ तक लौटने का रास्ता OCR ही है।

      संबंधित टूल

      DOCX को PDF में बदलें · PDF से EPUB · PDF से Markdown · PDF OCR (खोजने योग्य) · PDF से टेक्स्ट