PDF 提取文本

提取指定 PDF 頁面的文本,預覽後下載 UTF-8 TXT。不對掃描圖片進行 OCR。

免費 · 無須註冊 · 無須上載檔案

將檔案拖放到這裡

支援的檔案: PDF · 1 個檔案 · 最多 100 MB

編輯選項→ TXT

例如:1,3-5。留空表示所有頁面。

讀取 PDF 文檔現有的文本層

  1. 選擇包含可選取文字的 PDF。

  2. 在預覽中查看擷取的文字。

  3. 下載 TXT 檔案。

提取結果取決於 PDF 內部文本信息

將 PDF 轉為純文字會去除字型、圖片和版面,只留下文字,方便搬到其他編輯器。

多欄、表格、特殊字體或缺失字符映射可能影響順序。若部分頁面為空白或掃描圖,而其他頁面有文字,會提示部分提取。

支援的檔案

PDF → TXT

  • 1 個檔案 · 最多 100 MB
  • 輸入總大小: 300 MB
  • 輸出總大小: 150 MB
  • 頁碼: ≤ 200

不支援加密PDF。頁面操作不會編輯既有文字或執行OCR。

結果範例

原始檔案

結果範例: PDF 提取文本 (原始檔案)
journal-cover.pdf344.0 KB · 1 頁碼

結果

COASTAL NOTES THE SLOW ISSUE
BLURME / SAMPLE JOURNAL
A little closer
to the coast.
Light, texture and the pleasure of taking your time.
A table for two. A view for miles.
An imaginary travel journal, made for trying out your next edit.

常見問題

為什麼掃描 PDF 沒有提取出文本?
掃描可能只包含文字的圖片。本工具讀取已有的文本層,不識別圖片裏的字符。
PDF 文本提取能把表格還原為電子表格嗎?
不能。只輸出純文本,不重建單元格、列或佈局。
PDF 中的中文、韓文、日文和阿拉伯文能保留嗎?
UTF-8 支持這些字符,但能否提取取決於 PDF 的字符映射。請檢查缺字與順序。
可以按其他頁序提取 PDF 文本嗎?
可以。3,1-2 會先處理第三頁,再處理第一、二頁,不改變頁內閲讀順序。
檔案會上載到伺服器嗎?
不會。檔案在這部裝置的瀏覽器中處理,不會傳送到 BlurMe 伺服器。

相關工具

所有工具

使用 BlurMe 檢查並遮蓋文件中的個人資料。

下載需要免費註冊。免費匯出的檔案附有浮水印。