Édition & pages

Rendre les numérisations cherchables avec l'OCR

Reconnaître le texte

Pour un ordinateur, une page numérisée ou photographiée n'est qu'une image jusqu'à ce que Colophon lui applique une reconnaissance de texte sur l'appareil. Une reconnaissance rapide s'exécute automatiquement juste après une numérisation ou un import, uniquement pour alimenter la recherche dans la bibliothèque — elle ne modifie pas la page elle-même. Pour rendre ce texte sélectionnable et copiable sur la page, lancez manuellement Reconnaître le texte (OCR) depuis le menu du document.

Remarque
Tant que vous n'avez pas lancé Reconnaître le texte (OCR), le texte qui fait partie d'une image numérisée est invisible pour la sélection et la modification : il existe sur la page, mais Colophon ne peut pas encore y accéder comme texte, même s'il est déjà cherchable grâce au passage d'indexation automatique.

Ce qui devient cherchable

Une fois que vous avez lancé Reconnaître le texte (OCR), les mots de la page deviennent sélectionnables et copiables directement depuis l'image, de la même façon que sur n'importe quelle autre page.

La couche invisible, rendue visible

Le texte reconnu se superpose à l'image sous forme de couche invisible, alignée ligne par ligne avec ce qui figure sur la page, si bien que ce que vous voyez est la numérisation elle-même plutôt qu'un mur de texte superposé. Le mode Sélection de texte permet de sélectionner et de modifier directement cette couche cachée lorsqu'il faut corriger un mot mal reconnu.