你的檔案會留在你的裝置上

檔案在你的瀏覽器中處理,不會上傳到我們的伺服器。網站可能會下載處理引擎,並傳送不含檔案內容的使用或回饋事件。

我們如何處理你的資料

OCR PDF:產生可搜尋的 PDF

為最多 10 頁、10 MiB 的掃描版報告 PDF 加入可選取的英文、西班牙文或俄文文字,內容就能搜尋和引用。 檔案保留在瀏覽器中。

辨識檔案首次使用時約 26 MB,另加語言資料。

PDF · 最大 10 MiB,10 頁。文字最大 1 MiB;可搜尋的 PDF 最大 30 MiB。

辨識出的文字

試用範例

下載範例

選擇「繁體中文」。下載 PDF,搜尋「發票」、148.50、「出貨」和 2048。兩頁看起來都應與範例相同,且文字可選取、複製。

預期結果

每一頁會依序當作圖片辨識。可選擇英語、俄語與混合辨識。OCR 可能誤判字母、數字、欄與表格,請檢查結果。 這會以轉譯後的頁面圖片與隱形的文字層建立新的 PDF。可見的頁面大小與旋轉會保留;表單、連結、書籤、附件與數位簽章不會保留。既有的文字會重新辨識;圖片品質受限於轉譯解析度。

每頁最多轉譯為 4 百萬像素。載入與每個處理步驟最多 90 秒;整個工作會在 10 分鐘後停止。空白頁會在文字中標示。處理失敗或未辨識出任何文字時,不提供下載。

受保護的 PDF?請先用密碼解鎖。

第一次執行時可能需要下載轉換器檔案,會花上一些時間。若失敗,請檢查網路連線,或改用較小的檔案。「取消」會停止進行中的處理,之後可選擇其他檔案重試。

引擎授權與原始碼

實用指南

從掃描檔中搜尋並引用文字

  1. 選擇掃描版報告,不超過 10 頁和 10 MiB。
  2. 選擇英文、西班牙文或俄文進行辨識。
  3. 在結果中搜尋一個標題,確認文字層可用。

試用這個範例

用英文辨識一份 4 頁的掃描會議摘要;在結果 PDF 中搜尋第 3 頁的決議標題,應能找到。

開始之前: 辨識只涵蓋英文、西班牙文和俄文,限制為 10 頁和 10 MiB;低解析度的掃描可能出現辨識錯誤。