Richte schiefe Seiten aus, wähle die richtige Dokumentsprache und starte danach die OCR-Texterkennung. Prüfe anschließend besonders Namen, Zahlen und Sonderzeichen.
Warum dieses PDF-Problem entsteht
Erzeuge aus gescannten Bildseiten eine durchsuchbare Textebene und verbessere vorher Ausrichtung, Sprache und Bildqualität.
- Der Scanner hat nur Seitenbilder ohne Textinformation erzeugt.
- Eine falsche OCR-Sprache verfälscht Umlaute und Wörter.
- Schiefe, dunkle oder unscharfe Seiten senken die Erkennungsqualität.
- Handschrift und komplexe Tabellen werden nur eingeschränkt erkannt.
Schritt für Schritt zur Lösung
- Markiertest machen: Versuche ein Wort auszuwählen. Wird nur die ganze Seite markiert, fehlt die Textebene.
- Scan vorbereiten: Drehe Seiten, entferne leere Blätter und begradige erkennbare Schieflagen.
- OCR mit richtiger Sprache starten: Wähle Deutsch oder die tatsächliche Sprache und verarbeite zunächst einige Testseiten.
- Suchtest durchführen: Suche nach einem Namen, einer Zahl und einem Wort mit Umlaut. Korrigiere wichtige Erkennungsfehler.
Lösche das ursprüngliche Scanbild nicht. Die OCR-Textebene kann Fehler enthalten und ersetzt den sichtbaren Beleg nicht.
So prüfst Du das Ergebnis
Kopiere einen Absatz in einen Texteditor. Reihenfolge und Zeichen müssen verständlich übernommen werden.
Wenn das Problem danach weiter besteht, notiere den genauen Wortlaut der Meldung sowie Gerät und verwendetes Programm. Diese Angaben führen in der Suche zur passenderen nächsten Lösung.