PDF OCR 文字辨識
透過光學字元辨識(OCR)從掃描的 PDF 中擷取文字。
拖曳 PDF 檔案到此處,或點擊選擇檔案
支援 PDF 檔案
使用範例
從掃描的紙本文件中取出文字
用掃描器或拍照把紙本文件轉成 PDF 後,辨識其中的文字,變成可複製、可編輯的文字內容。
讀取沒有文字層的 PDF
對於只有圖片組成、一般「PDF 轉文字」工具無法處理的 PDF,也能透過 OCR 擷取內容。
辨識特定語言的文件
選擇對應的語言,例如英文、韓文或日文,可以提高該語言文件的辨識準確度。
常見問題
我上傳的 PDF 會傳送到伺服器嗎?
不會。把 PDF 轉成圖片以及辨識文字的過程都完全在您的瀏覽器中進行,上傳的 PDF 或其內容不會傳送到伺服器。唯一的例外是,您選擇語言的辨識模型檔案會在第一次使用時從公開 CDN 下載一次——這只是一般的程式檔案,與您文件的內容無關。
可以用在已經有文字的一般 PDF 上嗎?
可以,但如果 PDF 已經有文字層,建議使用我們的「PDF 轉文字」工具,速度更快、更準確。OCR 是為只有圖片的 PDF(例如掃描文件)設計的功能。
辨識準確度如何?
取決於掃描品質、字型與清晰度。解析度高、清晰的文件辨識準確度較高,手寫或模糊的掃描可能準確度較低。
頁數很多的 PDF 要花多久時間?
因為是逐頁依序辨識,所需時間會隨頁數增加。如果處理時間太長,可以隨時點擊取消按鈕中止。