利用 OCR 幫我們辨識那些無法直接修改的 PDF 文字。(ABBYY FineReader)
PDF 檔案是由 Adobe 公司所推行並已成為標準的檔案格式,它擁有跨平台、可保存檔案原始樣貌……等特色。也因此它也就成為許多公司間或公司內部資料交換的檔案格式,流通性不亞於一般的 Word 檔。
一般情況下,我們沒有編輯 PDF 檔案的需求,但在工作場合上,編輯 PDF 的需求會增加許多。如果有相對應的軟體,要編輯 PDF 也不是難事。
不過有時我們可能會發現,閱讀 PDF 時明明都是文字,怎麼在編輯 PDF 時,卻無法修改文字。其實這主要的原因是最一開始製作 PDF 時,這些文字,是以圖片的格式建立,而非一般的純文字格式所建立。也就是說,當我們編輯文字時,只能替換或刪除這張「文字圖片」,而無法直接修改「文字」。
那麼這種情況,就只能透過 OCR,也就是一般所指的文字辨識,透過軟體辨識出圖片上的文字,再轉譯成可供編輯修改的文字。
ABBYY FineReader 是一個具有 PDF 編輯功能的 OCR 軟體,我們可以利用它幫我們辨識 PDF 上那些無法直接修改的「文字圖片」,再轉譯成可供編輯修改的文字,並另存為 PDF、Word 或其他的格式。
接著會出現另存新檔的視窗,因為是 PDF 格式,先點一下【格式選項...】按鈕。
儲存模式這裡,要選擇為「頁面影像之上的文字」,其他不需修改,這樣子我們修改後的文字才能呈現。
設定的部份調整完畢之後,並設定完新檔名,再按一下【存檔】。
如果是試用版,會出現試用模式的訊息視窗,直接按下【繼續】即可。
儲存完畢之後,我們可以發現我們已經成功地將原本的『企業版』以及『專業版』的文字,修改為『中文版』以及『英文版』。