工具用的順手嗎?
你的回饋能幫助我們做得更好
為掃描版 PDF 加入可搜尋、可複製的文字層,支援繁體中文、簡體中文、英文與日文,並可自動校正傾斜及旋轉頁面。
點選檔案上傳PDF檔案
PDF (支援格式: .pdf)
最大 2.5 MB • 最多 5 個檔案
選擇文件中主要使用的語言組合。
校正掃描頁面的輕微傾斜。
偵測文字方向並旋轉至正確方向。
即使 PDF 已有文字層,也重新執行 OCR。
上傳檔案並配置選項後,點選開始處理
概覽
了解工具能解決的問題、計算或處理邏輯,以及資料邊界。
掃描器或手機拍攝產生的 PDF 通常只有頁面影像,無法選取文字,也無法在閱讀器中搜尋關鍵字。PDF OCR 會分析頁面影像,在原始畫面上加入隱藏文字層,讓姓名、編號、合約條款及書名等內容可供搜尋與複製,也能提高螢幕閱讀器擷取文字的可能性。輸出格式仍為 PDF,不會將頁面轉成 Word,也不會主動重新編排原始版面。
工具提供「簡體中文+英文」、「繁體中文+英文」、「英文」及「日文+英文」四種語言組合。選擇與內文相符的語言,有助於減少相似字形與標點符號的誤判。自動校正傾斜可修正輕微歪斜,自動旋轉則會依文字方向調整上下顛倒或橫向放置的頁面。「強制重新辨識」適用於已有錯誤文字層的檔案,但會增加處理時間。
指南
依步驟完成操作,並透過範例核對輸入與結果。
請先確認文件的主要語言,不需要選取所有語言。簡體中文資料通常選擇「簡體中文+英文」,繁體中文合約選擇「繁體中文+英文」,日文資料則選擇「日文+英文」。掃描頁面邊緣歪斜時可開啟傾斜校正;頁面方向不一致時,建議保留自動旋轉。一般圖片型 PDF 不需要啟用強制 OCR,只有在文字可被選取,但搜尋結果明顯錯誤,或文字層與畫面錯位時才需要使用。
上傳後請等待辨識完成,再用 PDF 閱讀器搜尋一個清楚出現的詞彙,並複製一段包含數字、日期及標點符號的文字進行核對。OCR 結果會受到解析度、壓縮、污漬、手寫字、直排文字、複雜表格及印章遮蔽等因素影響,重要資料仍須人工複核。
情境
查看這項工具在不同工作與生活流程中的用法。
紙本合約掃描後加入文字層,即可依客戶名稱或條款搜尋;書籍和講義處理後,可複製段落整理筆記;發票、收據及物流單據可先進行 OCR,再由人工登錄或執行後續資料擷取。日文說明書使用「日文+英文」組合,通常可同時辨識片假名、漢字及型號。處理大量歷史檔案前,建議先分批抽樣測試,再統一執行,以免選錯語言而必須整批重做。
OCR PDF 的用途是保留原始頁面並讓內容可供搜尋,不代表文件可完整編輯。若要修改段落、表格或圖片位置,可再使用 PDF 轉 Word;若只需要純文字,則可使用 PDF 轉文字。清晰的掃描檔通常比低畫質照片更可靠,建議確保頁面中的小字仍可辨識,且文字與背景具有足夠對比。
問答
集中解答常見疑問與容易混淆的問題。
影像模糊、頁面傾斜、混合字型及背景雜訊都可能降低準確度。建議改用原始掃描檔並開啟傾斜校正,重要欄位仍須逐項人工核對。
工具會以保留原始畫面為主,加入的文字層通常不會顯示。若頁面版面複雜,仍建議與原始檔案逐頁比對。
目前的處理流程主要針對印刷文字,無法保證手寫內容的辨識準確度。連筆、淡色筆跡及塗改都會進一步影響結果。
OCR 需要逐頁轉譯並辨識,頁數越多、解析度越高,所需時間也越長。首次啟動時也可能需要等待較久。
系統預設會略過已有文字的頁面。請先確認文字層有誤,再啟用強制 OCR,以免重複的文字層影響複製結果。
須知
使用前了解適用範圍、結果限制與必要提醒。
OCR 結果不應作為財務、醫療、法律或身分驗證的唯一依據。金額、小數點、日期、證件號碼及否定詞都須逐項對照原始影像。加入文字層可改善搜尋與複製功能,但不會自動建立完整的標題階層、閱讀順序或替代文字,因此不代表文件已完成符合無障礙標準的修復。
處理含有個人資料的掃描檔時,請限制下載連結與結果檔案的分享範圍。完成後建議保留原始掃描檔,以便對辨識結果有疑義時查核。若檔案設有密碼,須先取得合法授權並解除保護;若頁面嚴重破損、缺角或曝光過度,軟體無法還原原始影像中不存在的字元。
推薦
查找相關工具、專題與可用的 API 能力。