zh-Hant

PDF轉Markdown文件

在瀏覽器本地將PDF文字層轉換為Markdown,自動辨識標題、清單與段落結構,無需上傳檔案。

正在你的裝置上本機處理 ...

你的檔案

    正在你的裝置上本機處理 ...

    0%

    我的檔案會被上傳嗎?

    不會。一切都在你的瀏覽器中執行,你的檔案永遠不會離開你的裝置。這一點如何查證

    無需上傳100% 本機處理
    內容只留在你這裡第三方無法存取
    Hosted in GermanyGlobal Content Delivery
    通過獨立稽核TLS A+ · 標頭 A+

    Markdown是筆記、Wiki、靜態網站與AI工具的通用格式:簡潔、易於版本管理、隨處可讀。過去若想在這些情境中複用PDF內容,只能費力地手動複製。此工具讀取PDF的文字層,並以已具備基本結構的Markdown傳回,包含標題、項目清單與段落,而非一整面文字牆。

    結構偵測採用啟發式演算法:字型明顯大於內文的行會轉換為標題(#、## 或 ###),以項目符號或數字開頭的行會轉換為Markdown清單,行與行之間較大的垂直間距則代表新段落的開始。由此,從純粹的文字位置資訊中產生一份可讀、可複用的Markdown文件,是你在編輯器中進一步精修的理想起點。

    坦誠說明:這是結構近似,並非忠實的版面重建。表格、多欄頁面與精細格式無法從文字層無損還原。與純文字擷取一樣,掃描檔或純圖片PDF沒有文字層,結果將為空,此時請改用PDF OCR。所有處理均透過pdf.js在瀏覽器本地執行,檔案不會離開你的裝置。

    技術規格

    技術規格
    輸入格式PDF
    自動轉換PNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP
    輸出格式MD
    批次處理不支援
    處理方式在瀏覽器中本機處理 (JavaScript)
    檔案上傳

    三個步驟

    1. 將PDF拖放至工具中。
    2. 自動辨識文件結構。
    3. 下載Markdown檔案(.md)。

    限制: 將PDF現有文字層轉換為Markdown(UTF-8 .md)。標題、清單與段落透過字型大小和間距啟發式辨識,屬於結構近似,並非精確版面重建。表格和多欄頁面僅作線性近似。掃描檔或純圖片PDF沒有文字層,結果將為空,請改用PDF OCR。受密碼保護的PDF請先解除保護。 只讀取文字內容(pdf.js的getTextContent),嵌入的圖片不會帶入Markdown。

    常見問題

    標題是如何辨識的?

    依據字型大小判斷:比內文明顯更大的行,根據大小比例轉換為 #、## 或 ###。

    表格和多欄能保留嗎?

    不能。轉換屬於結構近似,表格和多欄版面僅作線性近似,並非原樣重建。

    為什麼我的Markdown是空的?

    你的PDF可能是掃描檔或由圖片構成,沒有文字層。請改用PDF OCR,它能從像素中辨識文字。

    PDF會被上傳嗎?

    不會。轉換完全在瀏覽器本地透過pdf.js執行,檔案不會離開你的裝置。

    相關工具

    PDF 轉文字 · PDF OCR 可搜尋轉換 · HTML 轉 Markdown · Markdown 輸出 PDF · 擷取PDF表格 · PDF轉Word