OCR PDF:產生可搜尋的 PDF
辨識掃描版 PDF,並加入英文、西班牙文或俄文的可選取文字。限制:每個檔案最多 10 頁、10 MiB。 檔案保留在瀏覽器中。
辨識檔案首次使用時約 26 MB,另加語言資料。
辨識出的文字
這個工具有幫助嗎?
試用範例
下載範例選擇「繁體中文」。下載 PDF,搜尋「發票」、148.50、「出貨」和 2048。兩頁看起來都應與範例相同,且文字可選取、複製。
預期結果
每一頁會依序當作圖片辨識。可選擇英語、俄語與混合辨識。OCR 可能誤判字母、數字、欄與表格,請檢查結果。 這會以轉譯後的頁面圖片與隱形的文字層建立新的 PDF。可見的頁面大小與旋轉會保留;表單、連結、書籤、附件與數位簽章不會保留。既有的文字會重新辨識;圖片品質受限於轉譯解析度。
每頁最多轉譯為 4 百萬像素。載入與每個處理步驟最多 90 秒;整個工作會在 10 分鐘後停止。空白頁會在文字中標示。處理失敗或未辨識出任何文字時,不提供下載。
受保護的 PDF?請先用密碼解鎖。
第一次執行時可能需要下載轉換器檔案,會花上一些時間。若失敗,請檢查網路連線,或改用較小的檔案。「取消」會停止進行中的處理,之後可選擇其他檔案重試。
實用指南
放入掃描檔,取出可搜尋的 PDF
- 選擇不超過 10 頁和 10 MiB 的掃描版 PDF。
- 選擇英文、西班牙文或俄文。
- 在產生的 PDF 中搜尋一個已知的字詞,檢查文字層。
試用這個範例
用英文辨識一份 2 頁的掃描發票;在產生的 PDF 中搜尋發票號碼,應能找到並標示出來。
開始之前: 只支援英文、西班牙文和俄文,且限制為 10 頁和 10 MiB;掃描品質不佳時,辨識的準確度會下降。