Bearbeitung & Seiten

Gescannte Dokumente mit OCR durchsuchbar machen

Text erkennen

Eine gescannte oder fotografierte Seite ist für einen Computer zunächst nur ein Bild, bis Colophon eine geräteinterne Texterkennung darüber laufen lässt. Ein kurzer Erkennungsdurchlauf läuft automatisch direkt nach einem Scan oder Import, nur um die Bibliothekssuche zu speisen — er verändert die Seite selbst nicht. Damit der Text auf der Seite auswählbar und kopierbar wird, führen Sie „Text erkennen (OCR)" manuell über das Dokumentmenü aus.

Hinweis
Bevor Sie „Text erkennen (OCR)" ausführen, ist Text, der Teil eines gescannten Bilds ist, für Auswahl und Bearbeitung unsichtbar: Er existiert auf der Seite, aber Colophon kann ihn noch nicht als Text erfassen, obwohl er dank des automatischen Indizierungsdurchlaufs bereits durchsuchbar ist.

Was durchsuchbar wird

Sobald Sie „Text erkennen (OCR)" ausführen, werden die Wörter der Seite direkt auf dem Bild auswählbar und kopierbar, genau wie auf jeder anderen Seite.

Die unsichtbare Ebene sichtbar machen

Erkannter Text liegt als unsichtbare Ebene über dem Bild, Zeile für Zeile an den Seiteninhalt angepasst, sodass Sie den Scan selbst sehen und nicht eine Wand aus überlagertem Text. Der Modus „Text auswählen" ermöglicht es, diese verborgene Ebene direkt auszuwählen und zu bearbeiten, wenn Sie ein falsch erkanntes Wort korrigieren möchten.