Bewerken en pagina's

Scans doorzoekbaar maken met OCR

Tekst herkennen

Een gescande of gefotografeerde pagina is voor een computer gewoon een afbeelding, totdat Colophon er tekstherkenning op het apparaat op loslaat. Meteen na een scan of import loopt automatisch een snelle herkenning, alleen om het zoeken in de bibliotheek te voeden — de pagina zelf verandert daardoor niet. Om die tekst op de pagina selecteerbaar en kopieerbaar te maken, voer je Tekst herkennen (OCR) handmatig uit via het menu van het document.

Opmerking
Zolang je Tekst herkennen (OCR) niet hebt uitgevoerd, is tekst die deel uitmaakt van een gescande afbeelding onzichtbaar voor selectie en bewerking: ze staat op de pagina, maar Colophon kan er nog niet als tekst bij, ook al is ze door de automatische indexeringspas al wel doorzoekbaar.

Wat doorzoekbaar wordt

Zodra je Tekst herkennen (OCR) uitvoert, worden de woorden van de pagina rechtstreeks vanaf de afbeelding selecteerbaar en kopieerbaar, net als op elke andere pagina.

De onzichtbare laag, zichtbaar gemaakt

Herkende tekst ligt als een onzichtbare laag over de afbeelding, regel voor regel uitgelijnd met wat er op de pagina staat, zodat je de scan zelf ziet in plaats van een muur aan overlappende tekst. Met de modus Tekst selecteren kun je die verborgen laag rechtstreeks selecteren en bewerken wanneer je een verkeerd herkend woord moet corrigeren.