OCR — 文字擷取

從數位 PDF 擷取文字,或對掃描影像執行光學字元辨識。

100% 免費
無需註冊
檔案自動刪除
安全處理

什麼是 OCR PDF,為什麼您需要它?

掃描的頁面其實只是一張照片:您的 PDF 閱讀器看到的是一張影像,而非文字。OCR PDF(光學字元辨識)會讀取那張影像、辨識每個字母,並把它變成真正、可選取且可搜尋的文字。這正是讓一份凍結的文件重獲新生的關鍵。

這一步改變了日常工作。文字一經辨識,您就能複製某個段落、在整份檔案中搜尋某個字詞,並無需重新打字就能再利用一份紙本文件。這正是您從掃描 PDF 擷取文字的原因:舊合約、郵寄收到的發票、填寫好的表單與數位化的檔案,終於變得可用。

什麼會影響準確度,以及接下來要做什麼

成果首先取決於掃描的品質。以 300 dpi 或更高解析度掃描、清晰、端正且高對比的文件,能帶來可靠的辨識。也務必選擇正確的語言,因為它會引導字元與重音符號的解讀方式。然而,手寫字仍不可靠:OCR 是為印刷文字而設計的。

文字擷取完成後,您可依目標挑選下一個工具。若要一份完全可編輯的文件,請用 pdf-to-word;若要直接調整檔案,請用 edit;而若要變更格式,就交給 convert 接手。

關於隱私,並不複雜:無需註冊,且您的檔案在處理後即自動刪除。您的文件僅用於產生您的文字,別無其他用途。

如何OCR — 文字擷取

  1. 1

    上傳

    將您的 PDF 檔案上傳至拖放區(或直接拖曳放入)。

  2. 2

    設定

    從數位 PDF 擷取文字,或對掃描影像執行光學字元辨識。

  3. 3

    下載

    一鍵下載處理後的文件——您的檔案在處理完成後會自動刪除。

相關 PDF 工具