При использовании функции распознавания PDF чаще всего возникают вопросы о точности распознавания, поддержке языков и редактировании после распознавания. В этом разделе собраны 4 частых вопроса и 4 термина глоссария.
Часто задаваемые вопросы
Что делать, если распознавание неточное?
- Проверьте, достаточно ли четкий отсканированный файл и не является ли текст размытым, наклоненным или закрытым тенями.
- При распознавании нескольких документов выберите более подходящий язык распознавания и вариант вывода.
- После распознавания внимательно проверьте числа, имена собственные и содержимое таблиц.
- Если исходное качество скана низкое, повторно отсканируйте файл перед запуском распознавания.
Какие языки распознавания поддерживаются?
- Язык распознавания можно задать при распознавании нескольких документов.
- Среди распространенных сценариев использования — документы на китайском, английском, японском, корейском и других языках.
- Если документ содержит несколько языков, сначала обработайте его с основным языком, а затем проверьте результат постранично.
Можно ли редактировать файл сразу после распознавания?
- Да. После распознавания текст становится доступным для редактирования.
- Сначала попробуйте выделить текст, чтобы убедиться, что это уже не просто изображение.
- После этого при необходимости можно редактировать, копировать, искать или сохранять документ.
Когда полезно распознавание нескольких документов?
- Оно подходит для одновременной обработки нескольких счетов, архивных материалов, отсканированных договоров или исследовательских материалов.
- Перед добавлением файлов заранее упорядочьте имена файлов и места сохранения, чтобы упростить последующее архивирование.
- После завершения пакетного распознавания проверьте ключевые страницы в каждом файле, чтобы убедиться, что результат соответствует вашим требованиям.
Глоссарий
| Термин | Описание |
|---|---|
| OCR | Оптическое распознавание символов — технология, которая преобразует текст на изображениях в машиночитаемый и редактируемый текст. |
| Сканированный PDF | PDF-файл, созданный путем сканирования бумажного документа, в котором содержимое страниц обычно представлено в виде изображений. |
| Распознавание одного документа | Способ распознавания, при котором обработка выполняется для одного открытого в данный момент сканированного PDF-файла. |
| Распознавание нескольких документов | Способ распознавания, при котором добавляются несколько сканированных PDF-файлов и обрабатываются одновременно. |