Bei der Nutzung von Text extrahieren mit KI drehen sich die häufigsten Fragen um Erkennungsgenauigkeit, gescannte PDFs und Formatierung. Diese FAQ enthält 4 häufige Fragen und ein Glossar mit 4 Begriffen.
FAQ
Was kann ich tun, wenn der extrahierte Text nicht korrekt ist?
- Prüfen Sie, ob das ursprüngliche PDF klar und vollständig ist.
- Führen Sie die Extraktion erneut aus und wählen Sie eine passendere Erkennungssprache.
- Überprüfen Sie nach der Extraktion Namen, Zahlen und Absatzumbrüche.
- Wenn es sich um eine gescannte Datei handelt, verwenden Sie nach Möglichkeit eine klarere Version des PDFs.
Kann ich Text aus einem gescannten PDF extrahieren?
- Ja, gescannte PDFs können verarbeitet werden.
- Öffnen Sie Text extrahieren mit KI und wählen Sie vor dem Start die passende Erkennungssprache aus.
- Prüfen Sie den erkannten Inhalt nach der Verarbeitung im Ergebnisbereich.
- Wenn das Ergebnis nicht zufriedenstellend ist, versuchen Sie es mit einem klareren Scan und führen Sie die Extraktion erneut aus.
Bleibt die ursprüngliche Formatierung im extrahierten Text erhalten?
- Das extrahierte Ergebnis versucht, den Textinhalt und die grundlegende Absatzstruktur beizubehalten.
- Komplexe Layouts, Tabellen oder mehrspaltige Inhalte müssen nach dem Export möglicherweise noch manuell nachbearbeitet werden.
- Wenn Sie den Inhalt weiter bearbeiten möchten, kann das Speichern als Word-Datei spätere Formatierungsanpassungen erleichtern.
Warum ist der Ergebnisbereich leer?
- Stellen Sie sicher, dass Sie auf Extraktion starten geklickt haben und warten Sie, bis der Vorgang abgeschlossen ist.
- Prüfen Sie, ob der ausgewählte Seitenbereich korrekt ist.
- Vergewissern Sie sich, dass Ihr Konto über den erforderlichen Mitgliedschaftszugang verfügt.
- Wenn die PDF-Seite leer, beschädigt oder unklar ist, kann das Ergebnis leer sein.
Glossar
| Begriff | Definition |
|---|---|
| OCR | Optische Zeichenerkennung – eine Technologie, die Text in Bildern oder gescannten Seiten in durchsuchbaren und auswählbaren Text umwandelt. |
| Extraktionsbereich | Der Seitenbereich, der für einen Extraktionsvorgang verwendet wird, zum Beispiel alle Seiten, die aktuelle Seite oder ein benutzerdefinierter Seitenbereich. |
| Erkennungssprache | Die vor der Extraktion ausgewählte Sprache, die sich auf Lesbarkeit und Erkennungsqualität auswirken kann. |
| Ergebnisbereich | Der Bereich, in dem der extrahierte Text nach der Verarbeitung angezeigt wird und in dem Sie das Ergebnis kopieren oder speichern können. |