th

PDF เป็น Word

แปลง PDF เป็นเอกสาร Word (DOCX) ที่แก้ไขได้ในเครื่อง หัวข้อ รายการ ตัวหนา/ตัวเอียง ตาราง และรูปภาพครบถ้วน ไม่มีการอัปโหลด

กำลังประมวลผลในเครื่องของคุณ ...

ไฟล์ของคุณ

    กำลังประมวลผลในเครื่องของคุณ ...

    0%

    ไฟล์ของคุณไม่เคยออกจากอุปกรณ์

      ทำต่อกับไฟล์นี้

      ไม่ต้องอัปโหลดซ้ำ

      เครื่องมือเหล่านี้รองรับ .DOCX - ไฟล์ของคุณจะถูกส่งต่อโดยตรง

      ไฟล์ของฉันถูกอัปโหลดไหม

      ไม่ ทุกอย่างทำงานในเบราว์เซอร์ของคุณ - ไฟล์ของคุณไม่เคยออกจากอุปกรณ์ ตรวจสอบเรื่องนี้ได้อย่างไร

      ไม่ต้องอัปโหลดทำงานในเครื่อง 100%
      เนื้อหายังอยู่กับคุณไม่มีบุคคลที่สามเข้าถึง
      Hosted in GermanyGlobal Content Delivery
      ตรวจสอบโดยอิสระTLS A+ · ส่วนหัว HTTP A+

      PDF คือหน้ากระดาษที่จัดวางเสร็จแล้ว ไม่ใช่ข้อความที่แก้ไขได้ ย่อหน้าเลือกยาก ประโยคเขียนใหม่ไม่คล่อง และตารางก็คำนวณต่อไม่ได้ เครื่องมือนี้อ่านโครงสร้างจริงของ PDF ของคุณ ทั้งหัวเรื่อง ย่อหน้า รายการ ตาราง เชิงอรรถ และรูปภาพ แล้วสร้างจากสิ่งเหล่านั้นเป็นไฟล์ DOCX ของจริงในรูปแบบ Office Open XML บนอุปกรณ์ของคุณเอง ไฟล์ที่ได้เปิดได้ทันทีใน Word ใน LibreOffice Writer หรือในโปรแกรมอื่นใดที่เข้าใจไฟล์ .docx ไม่มีลายน้ำ ไม่ต้องสมัครบัญชี ไม่มีโควตารายวัน เพราะการแปลงเกิดขึ้นในแท็บเบราว์เซอร์ ไม่ใช่บนเซิร์ฟเวอร์

      ในระดับย่อหน้าและตัวอักษร สิ่งที่คงอยู่มีมากกว่าตัวหนาและตัวเอียง หัวเรื่องกลายเป็นหัวเรื่อง Word ของจริงตั้งแต่ระดับ 1 ถึง 6 พร้อมระดับเค้าร่าง บานหน้าต่างนำทางและสารบัญอัตโนมัติจึงใช้งานได้ทันที รายการหัวข้อย่อยที่ซ้อนกันยังคงระดับของตนไว้เป็นรายการหลายระดับของจริง เส้นใต้และเส้นขีดฆ่าถูกจำแนกจากเส้นที่วาดไว้จริงบนหน้ากระดาษ ตัวยกและตัวห้อยจำแนกจากเส้นฐานที่เยื้องไป ส่วนการเน้นข้อความด้วยสีจะถูกจับคู่กับสีที่ใกล้เคียงที่สุดใน 16 สีเน้นข้อความที่รูปแบบ Word รู้จัก ลิงก์จาก PDF กลายเป็นไฮเปอร์ลิงก์ Word ที่คลิกได้ และหมายเหตุที่ท้ายหน้ากลายเป็นเชิงอรรถ Word ของจริงในระบบจัดการเชิงอรรถ ไม่ใช่ข้อความลอยอยู่ท้ายหน้า

      ตารางถูกตรวจพบผ่านสามเส้นทางที่แยกจากกัน หนึ่งคือจากเส้นกรอบที่วาดไว้จริง ซึ่งความกว้างคอลัมน์มาจากตำแหน่งเส้นที่วัดได้ และเซลล์ที่ผสานอย่างเรียบง่ายก็ยังคงผสานอยู่ สองคือจากช่องว่างระหว่างคอลัมน์ที่ซ้ำอย่างชัดเจน เมื่อตารางไม่มีเส้นเลย และสามคือจากลำดับอย่างน้อยสามบรรทัดติดกันในรูป «ช่อง: ค่า» อย่างที่ PDF แบบฟอร์มมักสร้างขึ้น ขนาดหน้ากระดาษ แนวตั้งหรือแนวนอน ระยะขอบ และจำนวนคอลัมน์ข้อความ ล้วนนำมาจากเรขาคณิตจริงของหน้า ไม่ใช่จากการเดาว่าเป็น A4 ทุกรอยต่อของหน้าเดิมจะมีตัวแบ่งหน้าที่สะอาด และรูปภาพถูกฝังไว้ตรงตำแหน่งเดิมในลำดับการอ่านโดยคงสัดส่วนไว้ แม้แผนภูมิที่วาดด้วยเวกเตอร์ล้วนก็ถูกจำแนกเป็นภาพประกอบ หัวกระดาษและท้ายกระดาษที่ปรากฏซ้ำจะกลายเป็นหัวกระดาษและท้ายกระดาษ Word ของจริงพร้อมจุดแท็บซ้าย กึ่งกลาง และขวา เลขหน้าที่ไล่ต่อเนื่องจะกลายเป็นเขตข้อมูล Word ที่มีชีวิตแทนตัวเลขที่ถูกแช่แข็ง และลายน้ำที่ปรากฏซ้ำก็ถูกนำติดมาด้วย

      เรื่องแบบอักษร เครื่องมือนี้เลือกทางตรง โปรแกรมฟอนต์ที่ฝังอยู่ใน PDF ต้นทางถูกย้ายเข้าไฟล์ Word โดยไม่ดัดแปลง แยกกันสำหรับน้ำหนักปกติ หนา เอียง และหนาเอียง ย่อหน้าที่เป็นตัวหนาจึงได้เส้นรอบรูปจริงจากการออกแบบตัวอักษร ไม่ใช่ความหนาที่โปรแกรมประมวลผลคำคำนวณขึ้นภายหลัง เฉพาะตรงที่ PDF ไม่ได้พาแบบอักษรมาด้วยเลยเท่านั้น จึงจะมีแบบอักษรทดแทนที่ความกว้างตัวอักษรเข้ากันได้และมีสัญญาอนุญาตแบบเปิดเข้ามาแทน ซึ่งก็ถูกฝังลงในไฟล์เช่นกัน เอกสารจึงแสดงผลถูกต้องแม้บนเครื่องของคนอื่นที่ไม่ได้ติดตั้งแบบอักษรเหล่านั้น ข้อความนอกอักษรละตินยังได้รับการกำกับระบบการเขียนและภาษาที่เหมาะสม เพื่อให้ Word จัดรูปภาษาจีน ญี่ปุ่น เกาหลี อาหรับ หรือฮีบรูได้ถูกต้อง เรียงจากขวาไปซ้ายในที่ที่ควรเป็น และให้ตัวตรวจการสะกดเลือกภาษาได้ถูก

      งานส่วนใหญ่อยู่ที่ PDF ซึ่งหลุดออกจากกรอบปกติ หน้าที่บันทึกไว้ในแนวขวางจะถูกวิเคราะห์ตามทิศทางการอ่านของหน้านั้นเอง ตารางบนหน้านั้นจึงไม่มาถึงในสภาพสลับแถวสลับคอลัมน์ และหัวเรื่องก็ไม่กลายเป็นตัวตั้งขึ้นมาเฉย ๆ ส่วน PDF ที่พิมพ์ออกมาจากเบราว์เซอร์ เช่นผ่าน «พิมพ์เป็น PDF» ใน Chrome หรือ Edge จะวาดจุดนำหน้ารายการเป็นสี่เหลี่ยมเวกเตอร์จิ๋วแทนที่จะเป็นตัวอักษร และยังเชื่อมทั้งแถวของตารางให้กลายเป็นข้อความบรรทัดเดียว ทั้งสองกรณีถูกจำแนกจากเรขาคณิตแล้วแยกกลับเป็นรายการของจริงและเซลล์แต่ละเซลล์ เลขหน้าจะกลายเป็นหัวหรือท้ายกระดาษก็ต่อเมื่อมันไล่นับต่อเนื่องข้ามหน้าจริง ๆ บรรทัดเดี่ยวที่เพียงแค่ดูเหมือนเลขหน้าจะยังคงอยู่ในเนื้อความ และรหัสหน้าที่เปลี่ยนไปเรื่อย ๆ อย่าง «K-6» หรือ «K-86» จะถูกเก็บไว้แทนที่จะถูกทิ้งไปในฐานะส่วนประกอบข้างเคียง

      มีสองเรื่องที่เครื่องมือนี้บอกคุณตรง ๆ แทนที่จะปิดเงียบ หากใน PDF ต้นทางมีข้อความอยู่หลังแถบดำทึบแต่ยังอ่านออกมาเป็นข้อความได้ นั่นคือความผิดพลาดคลาสสิกของการปิดบังด้วยการวาดสี่เหลี่ยมทับ ข้อความนั้นจะไม่ถูกนำเข้าไฟล์ Word และคุณจะได้รับแจ้งว่าเกิดขึ้นที่หน้าใดบ้าง และหากตัวอักษรใน PDF ไม่มีค่า Unicode กำกับเลย ซึ่งเป็นสาเหตุที่การคัดลอกจากโปรแกรมอ่าน PDF ใด ๆ ก็ล้มเหลวเช่นกัน สัดส่วนของตัวอักษรเหล่านั้นจะถูกระบุเป็นตัวเลขและคุณจะถูกชี้ไปที่ «PDF OCR» แทนที่จะถูกทิ้งไว้กับช่องว่างที่เงียบงัน การวิเคราะห์และการประกอบไฟล์เกิดขึ้นทั้งหมดในแท็บเบราว์เซอร์ ไฟล์ PDF ของคุณไม่ออกจากอุปกรณ์ และหลังโหลดครั้งแรกเครื่องมือนี้ยังใช้งานแบบออฟไลน์ได้ด้วย

      ข้อมูลทางเทคนิค

      ข้อมูลทางเทคนิค
      รูปแบบที่รองรับPDF
      การแปลงอัตโนมัติPNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
      รูปแบบผลลัพธ์DOCX
      การประมวลผลเป็นชุดไม่รองรับ
      การประมวลผลภายในเบราว์เซอร์ (JavaScript)
      การอัปโหลดไฟล์ไม่มี

      ใน 3 ขั้นตอน

      1. วาง PDF ของคุณ ไม่มีอะไรถูกอัปโหลด
      2. โครงสร้าง ตาราง แบบอักษร และรูปภาพถูกตรวจพบในเครื่องแล้วย้ายเข้าสู่ DOCX
      3. ดาวน์โหลด DOCX แล้วแก้ไขต่อใน Word หรือ LibreOffice

      ข้อจำกัด: เป็นการถ่ายทอดเชิงโครงสร้าง ไม่ใช่การคัดลอก PDF ทีละพิกเซล สิ่งที่ถูกถ่ายทอด ได้แก่ หัวเรื่องพร้อมระดับเค้าร่าง ย่อหน้า รายการลำดับเลขและหัวข้อย่อยหลายระดับ ตัวหนา ตัวเอียง เส้นใต้ เส้นขีดฆ่า ตัวยกและตัวห้อย การเน้นข้อความ (ปัดเข้าหาสีเน้นข้อความของ Word) ไฮเปอร์ลิงก์ที่คลิกได้ เชิงอรรถของจริง รูปภาพและแผนภูมิเวกเตอร์ในลำดับการอ่าน หัวกระดาษและท้ายกระดาษของจริงพร้อมเขตข้อมูลเลขหน้าที่มีชีวิต รวมทั้งขนาดหน้า แนวการวาง ระยะขอบ และจำนวนคอลัมน์จากเรขาคณิตจริง ตารางถูกตรวจพบจากเส้นกรอบ จากช่องว่างระหว่างคอลัมน์ที่ซ้ำ หรือจากบรรทัดในรูป «ช่อง: ค่า» ขณะนี้ประเมินพื้นที่ตารางที่ต่อเนื่องกันได้เพียงหนึ่งพื้นที่ต่อหน้า ดังนั้นหากมีตารางหลายตารางที่มีกรอบของตัวเองวางซ้อนกันในหน้าเดียว ตารางเหล่านั้นจะไหลผ่านเป็นข้อความปกติโดยตั้งใจ แทนที่จะถูกประกอบผิด และตารางที่ซ้อนลึกหรือผสานเซลล์จำนวนมากก็ยังเป็นจุดอ่อน ทุกเซลล์บรรจุหนึ่งย่อหน้า ข้อจำกัดอื่นที่ขอบอกตามตรง ช่วงข้อความสีที่อยู่ภายในช่วงข้อความที่เรียงต่อเนื่องกันจะสูญเสียสีของตัวเอง และการเน้นที่ครอบเพียงบางส่วนจะระบายสีทั้งช่วง ลิงก์ที่ไม่มีที่อยู่ปลายทางบันทึกไว้ใน PDF จะถูกข้าม ลิงก์ภายในเนื้อความเชิงอรรถจะไม่คงสภาพคลิกได้ รายการหัวข้อย่อยที่ซ้อนอยู่ในรายการลำดับเลขจะรับเครื่องหมายลำดับเลขในระดับของมัน (เนื้อหาและการซ้อนถูกต้อง เพียงเครื่องหมายเท่านั้นที่ไม่ตรง) หากหัวกระดาษเปลี่ยนไปตามบท มันจะคงอยู่เป็นข้อความปกติในเอกสารแทนที่จะกลายเป็นหัวกระดาษเฉพาะของแต่ละบท หน้าที่จัดวางอย่างประณีตมากโดยมีข้อความไหลล้อมรอบภาพจะได้ผลเพียงใกล้เคียง และในหน้าที่มีองค์ประกอบเส้นหรือเวกเตอร์หลายพันชิ้น การตรวจจับตารางและกราฟิกจะถูกข้ามไป PDF ที่ได้จากการสแกนหรือที่มีแต่รูปภาพจะไม่มีชั้นข้อความ กรณีนั้นจะปรากฏคำแนะนำไปยัง «PDF OCR» แทนผลลัพธ์ที่ว่างเปล่า ส่วน PDF ที่ป้องกันด้วยรหัสผ่าน ให้เปิดด้วย «ปลดล็อก PDF» ก่อน

      คำถามที่พบบ่อย

      ไฟล์ PDF ถูกอัปโหลดหรือไม่

      ไม่ ไฟล์ PDF ถูกเปิดในแท็บเบราว์เซอร์ วิเคราะห์ที่นั่น และไฟล์ Word ก็ถูกประกอบขึ้นที่นั่นเช่นกัน ไม่มีเซิร์ฟเวอร์ใดได้เห็นไฟล์ของคุณเลย หลังการเข้าใช้ครั้งแรก เครื่องมือนี้ยังทำงานได้แม้ในโหมดเครื่องบิน ซึ่งเป็นข้อพิสูจน์ที่ง่ายที่สุดว่าไม่มีอะไรถูกอัปโหลด

      ไฟล์ Word จะหน้าตาเหมือน PDF ทุกประการหรือไม่

      ไม่ และนั่นเป็นความตั้งใจ PDF คือการจัดวางที่ตายตัว ส่วนเอกสาร Word คือข้อความที่ไหลได้ การคัดลอกทีละจุดจะทำให้แก้ไขใน Word อย่างมีความหมายไม่ได้อีก สิ่งที่ถ่ายทอดมาจึงเป็นความหมาย ได้แก่ หัวเรื่อง ย่อหน้า รายการ ตาราง เชิงอรรถ รูปภาพ หัวและท้ายกระดาษ รวมทั้งขนาดหน้าและระยะขอบ หน้าที่จัดวางอย่างประณีตมากโดยมีข้อความไหลล้อมรอบภาพจะได้ผลเพียงใกล้เคียง

      หัวเรื่องยังคงเป็นหัวเรื่อง Word ของจริงหรือไม่

      ใช่ บรรทัดที่จัดด้วยขนาดใหญ่กว่าและหนักกว่าจะถูกจำแนกเป็นหัวเรื่องระดับ 1 ถึง 6 และได้รับระดับเค้าร่างที่สอดคล้องกัน ด้วยเหตุนี้ไม่เพียงชุดรูปแบบเท่านั้นที่ใช้งานได้ แต่บานหน้าต่างนำทางและสารบัญที่ Word สร้างอัตโนมัติก็ใช้งานได้ทันที โดยคุณไม่ต้องจัดรูปแบบเองอีก

      แบบอักษรเดิมจาก PDF ยังคงอยู่หรือไม่

      ใช่ หาก PDF พามาด้วย ไฟล์ฟอนต์ที่ฝังอยู่ใน PDF ต้นทางถูกย้ายเข้าไฟล์ Word โดยไม่ดัดแปลง แยกกันสำหรับน้ำหนักปกติ หนา เอียง และหนาเอียง ต่อเมื่อ PDF ขาดแบบอักษรใดไปเท่านั้น จึงจะมีแบบอักษรทดแทนที่ความกว้างตัวอักษรเข้ากันได้และมีสัญญาอนุญาตแบบเปิดเข้ามาแทน ซึ่งก็ถูกฝังไว้ด้วย เอกสารจึงแสดงผลถูกต้องแม้บนเครื่องที่ไม่ได้ติดตั้งแบบอักษรเหล่านั้น

      ตารางยังคงอยู่หรือไม่

      ตารางที่มีเส้นกรอบมองเห็นได้จะกลายเป็นตาราง Word ของจริง โดยความกว้างคอลัมน์มาจากตำแหน่งเส้นที่วัดได้ และเซลล์ที่ผสานอย่างเรียบง่ายยังคงสมบูรณ์ ตารางที่ไม่มีกรอบแต่มีช่องว่างระหว่างคอลัมน์ซ้ำอย่างชัดเจน รวมทั้งบรรทัดแบบฟอร์มในรูป «ช่อง: ค่า» ก็ถูกตรวจพบเช่นกัน ขณะนี้ประเมินพื้นที่ตารางที่ต่อเนื่องกันได้เพียงหนึ่งพื้นที่ต่อหน้า หากมีตารางหลายตารางที่มีกรอบของตัวเองวางซ้อนกัน ตารางเหล่านั้นจะไหลผ่านเป็นข้อความปกติโดยตั้งใจ แทนที่จะถูกประกอบผิด

      ใช้กับหน้าที่หมุนหรือหน้าแนวนอนได้หรือไม่

      ได้ หน้าที่ถูกบันทึกไว้ในสภาพหมุนภายใน PDF จะถูกวิเคราะห์ตามทิศทางการอ่านของหน้านั้นเอง ไม่ใช่ตามทิศทางของส่วนที่เหลือในเอกสาร ตารางบนหน้าเช่นนั้นจึงคงแถวและคอลัมน์ไว้ในทิศทางที่ถูกต้อง และหัวเรื่องก็ไม่ถูกเข้าใจผิดว่าเป็นข้อความที่จัดในแนวตั้ง

      รายการหัวข้อย่อยจาก PDF ที่พิมพ์ผ่านเบราว์เซอร์ถูกตรวจพบหรือไม่

      ใช่ ตอนพิมพ์เป็น PDF นั้น Chrome และ Edge วาดจุดของรายการไม่ใช่ในฐานะตัวอักษร แต่เป็นสี่เหลี่ยมเวกเตอร์จิ๋ว ทำให้เครื่องหมายรายการมองไม่เห็นสำหรับตัวอ่านข้อความล้วน เครื่องมือนี้จำแนกจากขนาดของมันและจากการที่มันเรียงตรงกันในคอลัมน์เดียว แล้วกู้รายการคืนมาพร้อมทุกระดับ จากแหล่งเดียวกันนี้ แถวตารางที่ถูกเชื่อมติดกันก็ถูกแยกกลับเป็นเซลล์แต่ละเซลล์ด้วย

      รูปภาพ ลิงก์ และเชิงอรรถถูกถ่ายทอดมาหรือไม่

      ใช่ ทั้งสามอย่าง รูปภาพที่ฝังอยู่ถูกแทรกไว้ตรงตำแหน่งเดิมในลำดับการอ่าน โดยจำกัดความกว้างและคงสัดส่วนไว้ แผนภูมิที่วาดด้วยเวกเตอร์ล้วนก็ถูกจำแนกเป็นภาพประกอบเช่นกัน ลิงก์ที่มีปลายทางบันทึกไว้จะกลายเป็นไฮเปอร์ลิงก์ Word ที่คลิกได้ และหมายเหตุที่ท้ายหน้าจะกลายเป็นเชิงอรรถ Word ของจริง ลิงก์ที่ไม่มีที่อยู่ปลายทางจะถูกข้าม และลิงก์ภายในเนื้อความเชิงอรรถจะไม่คงสภาพคลิกได้

      ข้อความที่ถูกแถบดำปิดทับใน PDF ต้นทางจะเป็นอย่างไร

      ข้อความนั้นจะไม่ถูกนำเข้าไฟล์ Word หากการปิดบังทำโดยการวาดสี่เหลี่ยมสีดำทับข้อความแทนที่จะลบข้อความออกจริง ข้อความนั้นยังคงอ่านได้ครบถ้วนภายใน PDF ซึ่งเป็นความผิดพลาดที่พบบ่อยและมีผลกระทบหนัก เครื่องมือนี้จำแนกข้อความที่อยู่หลังพื้นที่ทึบสีเข้มทั้งหมด ตัดออกไป และแจ้งคุณว่าเกิดขึ้นที่หน้าใดบ้าง

      ถ้าเป็น PDF ที่ได้จากการสแกนจะเป็นอย่างไร

      ไฟล์สแกนประกอบด้วยรูปภาพและไม่มีชั้นข้อความ เครื่องมือนี้บอกตามตรงและชี้ไปที่ «PDF OCR» แทนที่จะสร้างไฟล์ Word ที่ว่างเปล่า หากไฟล์มีข้อความอยู่จริงแต่ตัวอักษรไม่มีค่า Unicode บันทึกไว้ สัดส่วนที่ได้รับผลกระทบจะถูกระบุเป็นตัวเลข ในกรณีนั้นการคัดลอกจากโปรแกรมอ่าน PDF ก็ล้มเหลวเช่นกัน และ OCR คือทางกลับสู่ข้อความ

      เครื่องมือที่เกี่ยวข้อง

      แปลง DOCX เป็น PDF · PDF เป็น EPUB · PDF เป็น Markdown · PDF OCR (ค้นหาได้) · PDF เป็นข้อความ