Si vous avez besoin de récupérer un texte dactylographié, il existe des logiciels dit d’OCR (Optical Character Recognition) ou Reconnaissance Optique de Caractère, il existe un excellent moteur libre qui s’appelle Tesseract.
Il m’arrive d’utiliser un script pour automatiser le lancement de tesseract, histoire d’éviter la ligne de commande. C’est XSane2tess dont j’ai jadis parlé en… octobre 2011 🙂
Je maintiens toujours le script sur AUR, trouvé via une page sur le wiki d’ubuntu-fr.org. Un simple script qu’il est très simple d’installer dans Xsane. Je vous renvoie à l’article d’octobre 2011 pour les détails techniques.
Continuer la lecture de « L’OCR sous les distributions GNU/Linux ? Merci xsane2tess et tesseract 🙂 »

