th

ดึงตารางจาก PDF

ตรวจจับตารางใน PDF แล้วส่งออกเป็น CSV, Excel (XLSX) หรือ JSON ได้ทั้งแบบมีและไม่มีเส้นขอบ ทำงานในเบราว์เซอร์ ไม่มีการอัปโหลด

กำลังประมวลผลในเครื่องของคุณ ...

รูปแบบผลลัพธ์ รูปแบบปลายทางของไฟล์ผลลัพธ์
  • CSV
  • Excel (XLSX)
  • JSON
การตรวจจับตาราง
  • อัตโนมัติ
  • มีเส้นขอบ (กริด)
  • ไม่มีเส้นขอบ (ระยะห่าง)
ตัวคั่น
  • จุลภาค
  • อัฒภาค
  • แท็บ

ไฟล์ของคุณ

    กำลังประมวลผลในเครื่องของคุณ ...

    0%

    ไฟล์ของฉันถูกอัปโหลดไหม

    ไม่ ทุกอย่างทำงานในเบราว์เซอร์ของคุณ - ไฟล์ของคุณไม่เคยออกจากอุปกรณ์ ตรวจสอบเรื่องนี้ได้อย่างไร

    ไม่ต้องอัปโหลดทำงานในเครื่อง 100%
    เนื้อหายังอยู่กับคุณไม่มีบุคคลที่สามเข้าถึง
    Hosted in GermanyGlobal Content Delivery
    ตรวจสอบโดยอิสระTLS A+ · ส่วนหัว HTTP A+

    ตัวเลขมักติดอยู่ตรงจุดที่นำไปใช้ต่อไม่ได้ นั่นคือในตารางของไฟล์ PDF ใบแจ้งหนี้ รายงาน รายการเดินบัญชี งานวิจัย ใครที่อยากได้ค่าเหล่านั้นไปใช้ใน Excel ฐานข้อมูล หรือสคริปต์ ที่ผ่านมาต้องพิมพ์ใหม่เองหรือทนกับคอลัมน์ที่พังเวลาคัดลอกแล้ววาง เครื่องมือนี้จะจดจำตารางใน PDF โดยอัตโนมัติและส่งออกโดยคงโครงสร้างไว้: เป็น CSV สำหรับสเปรดชีตและการนำเข้า เป็นสมุดงาน Excel (XLSX) ที่แยกชีตต่อหนึ่งตาราง หรือเป็น JSON พร้อมพิกัดสำหรับประมวลผลต่อในโค้ด

    การตรวจจับใช้เทคนิคสองแบบเดียวกับเครื่องมือเฉพาะทางที่มีชื่อเสียง: ตารางที่มีเส้นขอบจะถูกจดจำจากเส้นที่วาดจริงบนหน้ากระดาษ (โหมดกริด) เส้นเหล่านั้นประกอบกันเป็นกริดของเซลล์ และข้อความแต่ละส่วนถูกจัดเข้าเซลล์ของตน ส่วนตารางที่ไม่มีเส้นขอบจะถูกจดจำจากการจัดแนว (โหมดระยะห่าง): บล็อกข้อความที่อยู่ตำแหน่งคอลัมน์เดียวกันในหลายบรรทัดประกอบกันเป็นคอลัมน์ และช่องว่างที่ต่อเนื่องคือเส้นแบ่งคอลัมน์ โหมดอัตโนมัติจะหาเส้นก่อน หากไม่พบจึงใช้การวิเคราะห์ระยะห่าง ทั้งสองโหมดยังเลือกกำหนดเองได้ รองรับหลายตารางและ PDF หลายหน้า: ตารางที่ตรวจพบแต่ละตารางจะถูกส่งออกแยกกัน

    ตรงไปตรงมาและสำคัญ: การตรวจจับอ่านจากเลเยอร์ข้อความของ PDF ไฟล์ที่สแกนมาหรือประกอบด้วยรูปภาพล้วนไม่มีเลเยอร์นี้ ในกรณีนั้นเครื่องมือจะแจ้งตรง ๆ แทนที่จะสร้างตารางว่างเปล่าหรือกุขึ้นมา ให้แปลงไฟล์สแกนเป็นข้อความที่ค้นหาได้ด้วย "PDF OCR" ก่อน แล้วค่อยดึงตาราง เลย์เอาต์ที่ซับซ้อนก็มีข้อจำกัด: เซลล์ที่ผสานหรือตารางซ้อนกันจะได้ค่าโดยประมาณ ไม่ได้สร้างใหม่แบบพิกเซลต่อพิกเซล ทุกอย่างทำงานภายในเบราว์เซอร์ผ่าน pdf.js ไฟล์ของคุณไม่เคยออกจากอุปกรณ์

    หมายเหตุ: พิกัดใน JSON ใช้หน่วยพอยต์ของ PDF โดยจุดกำเนิดอยู่มุมล่างซ้าย จึงนำไปใช้ต่อกับไลบรารี PDF อื่น ๆ ได้ทันที

    ข้อมูลทางเทคนิค

    ข้อมูลทางเทคนิค
    รูปแบบที่รองรับPDF
    การแปลงอัตโนมัติPNG, JPG, GIF, BMP, TIFF, ZIP, DOCX
    รูปแบบผลลัพธ์CSV, XLSX, JSON
    การประมวลผลเป็นชุดไม่รองรับ
    การประมวลผลภายในเบราว์เซอร์ (JavaScript)
    การอัปโหลดไฟล์ไม่มี

    ใน 3 ขั้นตอน

    1. วางไฟล์ PDF ของคุณ
    2. เลือกรูปแบบผลลัพธ์และวิธีตรวจจับ
    3. ดาวน์โหลดตารางเป็น CSV, XLSX หรือ JSON

    ข้อจำกัด: ตรวจจับตารางจากเส้นขอบ (กริด) หรือการจัดแนวข้อความ (ระยะห่าง) แล้วส่งออกเป็น CSV (หนึ่งไฟล์ต่อหนึ่งตาราง หลายตารางรวมเป็น ZIP), XLSX (หนึ่งชีตต่อหนึ่งตาราง) หรือ JSON (พร้อมหน้า เซลล์ และตำแหน่งเป็นพอยต์ PDF) ต้องมีเลเยอร์ข้อความจริง: ไฟล์ PDF ที่สแกนมาให้แปลงก่อนด้วย "PDF OCR" เซลล์ที่ผสานและเลย์เอาต์ซับซ้อนจะได้ค่าโดยประมาณ ในไฟล์ Excel เฉพาะตัวเลขที่ชัดเจน (ทศนิยมจุด) เท่านั้นที่จะกลายเป็นเซลล์ตัวเลข ไฟล์ PDF ที่ล็อกรหัสผ่านให้เปิดก่อนด้วย "ปลดล็อก PDF"

    คำถามที่พบบ่อย

    เครื่องมือตรวจจับตารางอย่างไร

    ใช้เทคนิคสองแบบ: ตารางที่มีเส้นขอบ เส้นที่วาดไว้จะประกอบเป็นกริดของเซลล์ (โหมดกริด) ส่วนตารางที่ไม่มีเส้นขอบ จะจดจำคอลัมน์จากการจัดแนวข้อความและช่องว่างที่ต่อเนื่อง (โหมดระยะห่าง) โหมดอัตโนมัติเลือกเทคนิคที่เหมาะสมให้เอง

    ทำไมจึงไม่พบตารางในเอกสารสแกนของฉัน

    ไฟล์สแกนมีแต่พิกเซลของรูปภาพ ไม่มีเลเยอร์ข้อความให้อ่าน ให้แปลง PDF เป็นข้อความที่ค้นหาได้ด้วย "PDF OCR" ก่อน แล้วค่อยดึงตาราง

    ส่งออกหลายตารางหลายหน้าพร้อมกันได้ไหม

    ได้ ทุกหน้าจะถูกสแกน และตารางที่พบแต่ละตารางถูกส่งออกแยกกัน: เป็นไฟล์ CSV ของตัวเอง (หลายไฟล์รวมเป็น ZIP) เป็นชีตแยกในไฟล์ Excel หรือเป็นรายการใน JSON

    ไฟล์ JSON ที่ส่งออกมีอะไรบ้าง

    โครงสร้างครบถ้วน: แต่ละตารางมีหน้า โหมดตรวจจับ และตำแหน่ง แต่ละเซลล์มีข้อความและกรอบล้อมรอบเป็นพอยต์ PDF (จุดกำเนิดมุมล่างซ้าย) เหมาะสำหรับสคริปต์และไปป์ไลน์ข้อมูล

    ทำไมเซลล์ที่ผสานจึงไม่ตรงเป๊ะ

    เซลล์ที่ผสานข้ามหลายคอลัมน์ไม่มีตำแหน่งเดียวที่แน่นอนในกริด เนื้อหาจะตกไปอยู่ในเซลล์ใดเซลล์หนึ่ง ส่วนที่เหลือว่างเปล่า นี่คือการประมาณอย่างตรงไปตรงมา แม้แต่โปรแกรมเดสก์ท็อปเฉพาะทางก็แก้ปัญหานี้ได้ไม่สมบูรณ์

    ไฟล์ PDF ของฉันถูกอัปโหลดหรือไม่

    ไม่ การตรวจจับและการส่งออกทำงานภายในเบราว์เซอร์ทั้งหมดผ่าน pdf.js ไฟล์ไม่เคยออกจากอุปกรณ์ของคุณ

    การดึงตารางใช้บนสมาร์ตโฟนหรือ Chromebook ได้ไหม

    ได้ บนอุปกรณ์ใดก็ตามที่มีเบราว์เซอร์รุ่นใหม่ - Windows, Mac, Linux, Chromebook หรือสมาร์ตโฟน PDF ขนาดใหญ่มากแค่ต้องใช้เวลาและหน่วยความจำมากขึ้นบนอุปกรณ์มือถือ

    เครื่องมือที่เกี่ยวข้อง

    PDF เป็นข้อความ · PDF OCR (ค้นหาได้) · XLSX เป็น CSV · CSV เป็น XLSX · CSV เป็น JSON · PDF เป็น Markdown