PDF 轉文字擷取器的功能
從本機 PDF 依頁序擷取可讀文字,並將可見結果下載為 TXT 檔。選擇來源檔案、檢視相關頁面或輸出設定,並在下載新檔案前檢查可見結果。
在操作執行期間,所選檔案會保留在瀏覽器分頁中。NexaCurrent 不會上傳該 PDF、擷取的文字、渲染的影像、連結清單、詮釋資料值或產生的文件。關閉或重新整理頁面即可移除目前的結果。
方法與檔案處理方式
轉換工具會在本機端解析並呈現所選的檔案。頁面影像是瀏覽器可顯示內容的呈現,而文字萃取則是回傳讀取器所開放的文字圖層。這兩者是不同的工作項目,結果會標示實際執行的作業,而不是暗示已進行實際上並未執行的 OCR、Word 或可編輯排版轉換。
PDF 檔案是結構化的容器,而非一般的文字文件。一個頁面可能包含字型、向量、掃描影像、表單、註記、內嵌圖片、書籤、簽章及受保護的內容。工具僅執行頁面上所述的本機作業,並呈現其限制,而不是宣稱所有原始檔案特性都會在新匯出的副本中保留下來。
如何檢視輸出結果
先選擇一個小型且非機敏性的檔案,確認頁面清單或可見的設定,然後下載並以標準 PDF 讀取器開啟新副本。請比對頁面順序、尺寸、文字可見度、連結,以及對您的用途重要的浮水印或頁碼等內容。在獨立檢查輸出結果之前,請保留原始檔案。
受密碼保護或格式錯誤的 PDF 會遭到拒絕,而非被略過。此界線是有意為之:本瀏覽器套件協助使用者處理他們獲授權使用的檔案,但不會破解密碼、移除存取控制,或讓受保護的文件看起來像未受保護。
值得留意的限制
本工具會根據所選的檔案與設定產生新的本機輸出。複雜的 PDF 可能包含表單、書籤、簽章、圖層、腳本、加密、無障礙標籤或專有功能,而這些可能無法在以瀏覽器為基礎的頁面作業中保留。請保留原始檔案,並在使用匯出的副本作為最終紀錄前先行檢視。
瀏覽器處理適用於一般文件,而非無限的桌面排版或鑑識工作流程。頁數、檔案大小、呈現比例及輸出影像尺寸皆有上限。若文件較大、包含法律紀錄、具有數位簽章、需要精確的可編輯轉換,或必須符合歸檔標準,請使用經過審核的專業工作流程,並保留原始檔案。
私密的本機處理
文件和結果都保留在此瀏覽器分頁中。複製與下載動作僅在選取時才會執行,而「重設」會清除所選的檔案和可見的結果。NexaCurrent 並不會在作業過程中接收該文件。
當下一步作業有所變更時,請使用相關的 PDF 工具——例如,從合併文件轉為選取頁面萃取、文字檢視或影像匯出。請檢查新工具的設定,因為每項作業會保留和變更 PDF 中不同的部分。