Tesseract OCR est bien plus qu'un simple composant logiciel : c'est un effort collaboratif mondial pour rendre le savoir imprimé de l'humanité accessible aux machines et aux humains.
Notre Mission
Nous sommes convaincus que la reconnaissance de caractères de haute précision doit être un bien public. Notre mission est de fournir un moteur d'OCR de référence, 100 % gratuit et respectueux de la vie privée, utilisable partout : des serveurs haute performance aux smartphones et navigateurs web.
Accès Universel : Prise en charge de plus de 100 langues et écritures pour surmonter les fractures linguistiques.
Prêt pour le Web : Découvrez Tesseract dans votre navigateur grâce à notre Démo Web d'OCR en Ligne.
COMMUNAUTÉ OPEN SOURCE
La Chronologie de Tesseract
Du projet de recherche des années 1980 au moteur d'OCR libre le plus utilisé au monde.
1985 — 1994
Recherche HP
Développé à l'origine en tant que logiciel propriétaire dans les laboratoires de Hewlett-Packard à Bristol (Royaume-Uni) et Greeley (Colorado). L'un des moteurs les plus précis de son époque.
2005 — 2018
L'Ère Google
Google a libéré le code source de Tesseract en 2005 et en a soutenu le développement pendant plus de dix ans, introduisant notamment le réseau neuronal LSTM en version 4.
2019 — Aujourd'hui
Gouvernance Communautaire
Aujourd'hui, Tesseract est maintenu par une communauté mondiale de développeurs et demeure en 2026 la référence absolue de la reconnaissance optique de caractères open source.
Pourquoi le nom "Tesseract" ?
Le terme désigne un hypercube à 4 dimensions (tesseract). Tout comme un tesseract ajoute une dimension spatiale supplémentaire à un cube, notre moteur donne aux images statiques une nouvelle dimension d'utilité grâce aux données textuelles.
Rejoignez la Communauté
Nous accueillons avec enthousiasme les contributeurs : développeurs C++, linguistes pour les jeux de données et rédacteurs techniques pour la documentation.