L'ensemble de mes documents sont passés à la reconnaissance automatique de documents !
avec Tesseract, en local, suis pas fou, c'est des documents perso/administratifs
Certains résultats sont un peu bruités mais ce n'est pas grave ^^
Ça ne prends que 5,3Mo de stockage (en comparaison des 996Mo de la version image)
Prochaine étape, un algorithme qui suggère des métadonnées (expéditeur, date, ...) à partir du texte
Toujours pas de nom de projet par contre 😭
Web Developer and Devops specialized in Green IT, Privacy and Free Software. Co-founded RésiLien hosting provider.
Location: Côtes d'Armor, Bretagne, France.
Follows Open Source, Privacy, Ecology and Low Tech.
Ex-Devops @ruchequiditoui.
Ex-Web developer @gandi_net.
Toots in English and French.