使用「提取文字」功能時,最常見的問題涉及識別準確度、掃描 PDF 和格式;本常見問題包含 4 個常見問題和 4 個詞彙表。
常見問題
如果提取的文字不準確,我可以怎麼做?
- 檢查原始 PDF 是否清晰完整。
- 再次執行提取,並選擇更合適的識別語言。
- 提取後,校對人名、數字和段落分隔。
- 如果是掃描檔,若有更清晰的 PDF 版本,請嘗試使用。
我可以從掃描 PDF 中提取文字嗎?
- 可以,掃描 PDF 可以處理。
- 開啟「提取文字」功能,並在開始前選擇合適的識別語言。
- 處理完成後,在結果窗格中檢視識別內容。
- 如果結果不理想,嘗試使用更清晰的掃描檔,並再次執行提取。
提取的文字會保留原本的格式嗎?
- 提取結果會盡量保留文字內容和基本段落結構。
- 複雜的版面、表格或多欄內容,在匯出後可能仍需手動整理。
- 如果想繼續編輯,儲存為 Word 檔案可讓後續格式調整更方便。
為什麼結果窗格是空的?
- 請確認已點擊「開始提取」並等待處理完成。
- 檢查選取的頁面範圍是否正確。
- 確認您的帳戶具有所需的會籍權限。
- 如果 PDF 頁面是空白的、已損壞或不清楚,結果可能為空白。
詞彙表
| 詞彙 | 定義 |
|---|---|
| OCR | 光學字元辨識(Optical Character Recognition),一種將圖片或掃描頁面中的文字轉換為可搜尋、可選取文字的技術。 |
| 提取範圍 | 單次提取任務所使用的頁面範圍,例如所有頁面、目前頁面或自訂頁面範圍。 |
| 識別語言 | 提取前所選的語言,會影響文字的可讀性和識別品質。 |
| 結果窗格 | 處理後顯示提取文字的區域,您可以在這裡複製或儲存結果。 |