AI抽出の利用時によく寄せられる質問は、認識精度、スキャンされたPDF、書式に関するものです。このFAQでは、よくある4つの質問と4つの用語解説を掲載しています。
よくある質問
抽出されたテキストの精度が低い場合はどうすればよいですか?
- 元のPDFが鮮明で、内容が欠けていないか確認してください。
- 抽出を再実行し、より適切な認識言語を選択してください。
- 抽出後に、氏名、数値、段落区切りを見直してください。
- ファイルがスキャンPDFの場合は、より鮮明なPDFがあればそちらをお試しください。
スキャンされたPDFからテキストを抽出できますか?
- はい、スキャンされたPDFも処理できます。
- AI抽出を開き、開始前に適切な認識言語を選択してください。
- 処理後、結果パネルで認識された内容を確認してください。
- 結果が期待どおりでない場合は、より鮮明なスキャンを使用して、もう一度抽出を実行してください。
抽出されたテキストには元の書式が保持されますか?
- 抽出結果では、テキスト内容と基本的な段落構造をできるだけ保持します。
- 複雑なレイアウト、表、複数段組みの内容は、エクスポート後に手動で調整が必要になる場合があります。
- 引き続き編集する場合は、Wordファイルとして保存すると、後から書式を調整しやすくなります。
結果パネルが空なのはなぜですか?
- 「抽出を開始」をクリックし、処理が完了するまで待ったことを確認してください。
- 選択したページ範囲が正しいか確認してください。
- お使いのアカウントに必要な会員限定アクセス権があることを確認してください。
- PDFページが空白、破損、または不鮮明な場合、結果が空になることがあります。
用語集
| 用語 | 定義 |
|---|---|
| OCR | 光学文字認識のことです。画像やスキャンされたページ内の文字を、検索や選択が可能なテキストに変換する技術です。 |
| 抽出範囲 | 1回の抽出タスクで使用するページ範囲のことです。たとえば、すべてのページ、現在のページ、またはカスタムのページ範囲があります。 |
| 認識言語 | 抽出前に選択する言語です。可読性や認識品質に影響する場合があります。 |
| 結果パネル | 処理後に抽出されたテキストを表示する領域です。ここで結果をコピーまたは保存できます。 |