Tesseract OCR ist mehr als eine Software-Engine: Es ist ein weltweites kollaboratives Projekt, um das gedruckte Wissen der Menschheit für Maschinen und Menschen gleichermaßen zugänglich zu machen.
Unsere Mission
Wir glauben, dass hochwertige Texterkennung ein öffentliches Gut sein sollte. Unsere Mission ist es, eine branchenführende, 100 % kostenlose und datenschutzfreundliche OCR-Lösung bereitzustellen, die überall einsetzbar ist: von Hochleistungsservern bis zu Smartphones und Browsern.
Datenschutz zuerst: Keine Daten verlassen Ihren Rechner. Tesseract arbeitet standardmäßig vollständig offline.
Universeller Zugang: Unterstützung für über 100 Sprachen und Schriftsysteme zur Überwindung digitaler Barrieren.
Web-Ready: Erleben Sie Tesseract im Browser mit unserer installationsfreien Online Web OCR Demo.
COMMUNITY GETRIEBEN
Die Tesseract Chronik
Vom Forschungsprojekt in den 1980er Jahren zur weltweit beliebtesten Open-Source-OCR-Engine.
1985 — 1994
HP Research
Ursprünglich als proprietäre Software in den Hewlett-Packard Labs in Bristol (UK) und Greeley (Colorado) entwickelt. Eine der präzisesten Engines ihrer Zeit.
2005 — 2018
Die Google-Ära
Google veröffentlichte Tesseract 2005 als Open Source und förderte die Entwicklung über ein Jahrzehnt hinweg, inklusive Einführung des LSTM-Netzes in Version 4.
2019 — Heute
Community-Führung
Heute wird Tesseract von einer weltweiten Entwickler-Community gepflegt und bleibt auch 2026 der Goldstandard für quelloffene Zeichenerkennung.
Warum der Name "Tesseract"?
Der Begriff bezeichnet einen vierdimensionalen Hyperwürfel (Tesserakt). So wie ein Tesserakt einem Würfel eine weitere Dimension verleiht, so verleiht unsere Engine statischen Bildern eine neue Dimension des Nutzens durch strukturierte Daten.
Werden Sie Teil der Community
Wir freuen uns über Mitwirkende: C++ Programmierer, Linguisten für Trainingsdaten und Autoren für Dokumentation.