PDF 轉文字
把 PDF 的文字層擷取為一個純 .txt 檔案,便於複製、再利用或搜尋。在本機處理,無需上傳。
正在你的裝置上本機處理 ...
你的檔案
正在你的裝置上本機處理 ...
0%
你的檔案永遠不會離開你的裝置
我的檔案會被上傳嗎?
不會。一切都在你的瀏覽器中執行,你的檔案永遠不會離開你的裝置。這一點如何查證
把 PDF 的文字層擷取為一個純 .txt 檔案,便於複製、再利用或搜尋。在本機處理,無需上傳。
正在你的裝置上本機處理 ...
正在你的裝置上本機處理 ...
0%
你的檔案永遠不會離開你的裝置
不會。一切都在你的瀏覽器中執行,你的檔案永遠不會離開你的裝置。這一點如何查證
順序會依頁面逐一重建:位於同一高度的文字片段會組成一行,依照由上到下、由左到右的順序讀取。頁與頁之間以一個空行分隔,方便你直接重複使用、匯入或搜尋輸出結果。
| 輸入格式 | |
|---|---|
| 自動轉換 | PNG, JPG, WebP, GIF, BMP, TIFF, ICO, SVG, HEIC, ZIP, DOCX, DDS, HDR, PCX, WBMP |
| 輸出格式 | TXT |
| 批次處理 | 不支援 |
| 處理方式 | 在瀏覽器中本機處理 (JavaScript) |
| 檔案上傳 | 無 |
限制: 擷取 PDF 中現有的文字層,並以 UTF-8 的 .txt 檔案回傳;行由文字位置重建。掃描的或純影像的 PDF 沒有文字層,此時輸出為空:請改用 PDF OCR。字型、圖片、顏色與精確版面(多欄頁面、表格)會遺失,或只作線性近似。受密碼保護的 PDF 請先用解鎖 PDF 開啟。
很可能你的 PDF 是掃描檔或由圖片組成,沒有文字層。請改用從像素辨識文字的 PDF OCR。
不會。你得到的是依閱讀順序排列的純文字。字型、圖片、分欄與表格不會被原樣呈現。
UTF-8,因此中文與特殊字元都能正確保留。
頁與頁之間以一個空行分隔。
不會,文字擷取完全在瀏覽器中於本機完成。
PDF OCR 可搜尋轉換 · PDF轉Word · 擷取 PDF 頁面 · PDF轉Markdown文件 · DOCX 轉 HTML · DOCX 轉 Markdown