PDF 提取文字

提取指定 PDF 頁面的文字,預覽後下載 UTF-8 TXT。不對掃描圖片進行 OCR。

免費 · 無須註冊 · 無須上傳檔案

將檔案拖放到這裡

支援的檔案: PDF · 1 個檔案 · 最多 100 MB

編輯選項→ TXT

例如:1,3-5。留空表示所有頁面。

讀取 PDF 文件現有的文字層

  1. 選擇包含可選取文字的 PDF。

  2. 在預覽中查看擷取的文字。

  3. 下載 TXT 檔案。

提取結果取決於 PDF 內部文字資訊

將 PDF 轉為純文字會去除字型、圖片和版面,只留下文字,方便移到其他編輯器。

多欄、表格、特殊字型或缺失字元對映可能影響順序。若部分頁面為空白或掃描圖,而其他頁面有文字,會提示部分提取。

支援的檔案

PDF → TXT

  • 1 個檔案 · 最多 100 MB
  • 輸入總大小: 300 MB
  • 輸出總大小: 150 MB
  • 頁碼: ≤ 200

不支援加密PDF。頁面操作不會編輯既有文字或執行OCR。

結果範例

原始檔案

結果範例: PDF 提取文字 (原始檔案)
journal-cover.pdf344.0 KB · 1 頁碼

結果

COASTAL NOTES THE SLOW ISSUE
BLURME / SAMPLE JOURNAL
A little closer
to the coast.
Light, texture and the pleasure of taking your time.
A table for two. A view for miles.
An imaginary travel journal, made for trying out your next edit.

常見問題

為什麼掃描 PDF 沒有提取出文字?
掃描可能只包含文字的圖片。本工具讀取已有的文字層,不識別圖片裡的字元。
PDF 文字提取能把表格還原為電子表格嗎?
不能。只輸出純文字,不重建單元格、列或佈局。
PDF 中的中文、韓文、日文和阿拉伯文能保留嗎?
UTF-8 支援這些字元,但能否提取取決於 PDF 的字元對映。請檢查缺字與順序。
可以按其他頁序提取 PDF 文字嗎?
可以。3,1-2 會先處理第三頁,再處理第一、二頁,不改變頁內閱讀順序。
檔案會上傳到伺服器嗎?
不會。檔案會在這台裝置的瀏覽器中處理,不會傳送到 BlurMe 伺服器。

相關工具

所有工具

使用 BlurMe 檢查並遮蔽文件中的個人資訊。

下載需要免費註冊。免費匯出的檔案含有浮水印。