OCR PDF:產生可搜尋的 PDF
為最多 10 頁、10 MiB 的掃描版報告 PDF 加入可選取的英文、西班牙文或俄文文字,內容就能搜尋和引用。 檔案保留在瀏覽器中。
辨識檔案首次使用時約 26 MB,另加語言資料。
辨識出的文字
這個工具有幫助嗎?
試用範例
下載範例選擇「繁體中文」。下載 PDF,搜尋「發票」、148.50、「出貨」和 2048。兩頁看起來都應與範例相同,且文字可選取、複製。
預期結果
每一頁會依序當作圖片辨識。可選擇英語、俄語與混合辨識。OCR 可能誤判字母、數字、欄與表格,請檢查結果。 這會以轉譯後的頁面圖片與隱形的文字層建立新的 PDF。可見的頁面大小與旋轉會保留;表單、連結、書籤、附件與數位簽章不會保留。既有的文字會重新辨識;圖片品質受限於轉譯解析度。
每頁最多轉譯為 4 百萬像素。載入與每個處理步驟最多 90 秒;整個工作會在 10 分鐘後停止。空白頁會在文字中標示。處理失敗或未辨識出任何文字時,不提供下載。
受保護的 PDF?請先用密碼解鎖。
第一次執行時可能需要下載轉換器檔案,會花上一些時間。若失敗,請檢查網路連線,或改用較小的檔案。「取消」會停止進行中的處理,之後可選擇其他檔案重試。
實用指南
從掃描檔中搜尋並引用文字
- 選擇掃描版報告,不超過 10 頁和 10 MiB。
- 選擇英文、西班牙文或俄文進行辨識。
- 在結果中搜尋一個標題,確認文字層可用。
試用這個範例
用英文辨識一份 4 頁的掃描會議摘要;在結果 PDF 中搜尋第 3 頁的決議標題,應能找到。
開始之前: 辨識只涵蓋英文、西班牙文和俄文,限制為 10 頁和 10 MiB;低解析度的掃描可能出現辨識錯誤。