Zum Hauptinhalt springen
v5.3.0 Jetzt Verfügbar

Die beste kostenlose
OCR-Engine der Welt.

Tesseract OCR ist der branchenweite Open-Source-Standard für optische Zeichenerkennung. Mithilfe moderner neuronaler LSTM-Netzwerke extrahiert es Text aus Bildern mit über 99 % Genauigkeit in mehr als 100 Sprachen. Vollständig offline und sicher.

60k+
GitHub Sterne
100+
Unterstützte Sprachen
40Jahre
Bewährte Tradition
99%+
Erkennungsgenauigkeit
$0
Kosten — Für immer gratis
tesseract_demo.sh

$ # Text aus gescanntem Dokument extrahieren

$ tesseract dokument.tiff ausgabe -l deu --psm 3


$ cat ausgabe.txt

Franz jagt im komplett verwahrlosten Taxi quer durch Bayern. Dieser Text wurde mit einer Konfidenz von 99,8 % erfolgreich erkannt.

Drei Schritte zu strukturierten Daten.

Integrieren Sie Tesseract in Ihren Arbeitsablauf, um Bilder blitzschnell in bearbeitbaren Text und durchsuchbare PDFs zu verwandeln.

01

Bild bereitstellen

Unterstützt TIFF, JPEG, PNG und WebP. Tesseract nutzt Leptonica für zuverlässige Binarisierung, Rauschunterdrückung und Skalierung.

02

Layoutanalyse

Die Engine segmentiert die Seite in Textblöcke, Zeilen und Wörter. Wählen Sie aus 14 Seitensegmentierungsmodi (PSM).

03

Neuronale LSTM-Ausführung

Neuronale Netze werten die Zeilen sequentiell aus. Ausgabe als Klartext, hOCR, durchsuchbares PDF, TSV oder ALTO.

Browser-Demo

Tesseract Online testen — Ohne Installation

Konvertieren Sie Dokumente und Scans direkt in Ihrem Browser in Text und PDFs. 100 % privat.

Online-Konverter testen →

📥 Tesseract OCR installieren

In wenigen Minuten startklar. Wählen Sie unten Ihr Betriebssystem für die offizielle Installationsanleitung.

macOS Ubuntu / Debian Windows
Schritt 1

Bibliothek installieren

Installieren Sie die Kern-Engine über Homebrew.

os_install.sh

$ brew install tesseract

Schritt 2

Sprachpakete laden

Laden Sie zusätzliche .traineddata Modelle herunter.

lang_install.sh

$ brew install tesseract-lang

Schritt 3

Installation prüfen

Bestätigen Sie die Version auf Ihrem System.

check_version.sh

$ tesseract --version

Schritt 1

Bibliothek installieren

Direkt über die offiziellen apt Repositorien verfügbar.

apt_install.sh

$ sudo apt install tesseract-ocr

Schritt 2

Sprachpakete laden

Installieren Sie das deutsche Sprachpaket und weitere.

apt_lang.sh

$ sudo apt install tesseract-ocr-deu tesseract-ocr-all

Schritt 3

Installation prüfen

Prüfen Sie die installierte Version im Terminal.

verify_tess.sh

$ tesseract --version

Schritt 1

Windows-Installer

Der Community-Standard verwendet die vorkompilierten Binärdateien der Universität Mannheim (UB Mannheim).

UB Mannheim herunterladen
Schritt 2

System-PATH einrichten (Wichtig)

Fügen Sie den Installationsordner zu den Umgebungsvariablen von Windows hinzu.

  • Öffnen Sie das Windows-Startmenü und suchen Sie nach Umgebungsvariablen.
  • Klicken Sie auf Systemumgebungsvariablen bearbeiten.
  • Klicken Sie unten rechts auf die Schaltfläche Umgebungsvariablen....
  • Wählen Sie unter Systemvariablen den Eintrag Path und klicken Sie auf Bearbeiten.
  • Klicken Sie auf Neu und tragen Sie ein: C:\Program Files\Tesseract-OCR
  • Bestätigen Sie alle Dialoge mit OK und starten Sie Ihr Terminal oder VSCode neu.

⚡ Schnellübersicht der CLI-Befehle

Die wichtigsten Tesseract-Befehle für die tägliche Praxis.

Einfache Textextraktion

Extrahiert Text aus einem Bild in eine einfache .txt-Datei.

tesseract bild.png ausgabe

Sprache angeben (Deutsch)

Verwenden Sie den Parameter -l für die Zielsprache (z. B. Deutsch).

tesseract bild.png ausgabe -l deu

Mehrere Sprachen gleichzeitig

Kombinieren Sie Sprachen mit + für mehrsprachige Dokumente.

tesseract bild.png ausgabe -l deu+eng

Durchsuchbares PDF erstellen

Erstellt ein PDF mit unsichtbarem, markierbarem Text über dem Originalbild.

tesseract bild.png ausgabe pdf

Bounding Boxes extrahieren (hOCR)

Erhalten Sie genaue Pixelkoordinaten jedes erkannten Wortes in HTML.

tesseract bild.png ausgabe hocr

Layout-Segmentierung (PSM)

Gezielte Verarbeitung eines einheitlichen Textblocks mit --psm 6.

tesseract bild.png ausgabe --psm 6

Installierte Sprachen auflisten

Zeigt alle auf Ihrem Computer installierten Sprachmodelle an.

tesseract --list-langs

TSV-Tabelle exportieren

Exportiert Wortdaten und Konfidenzwerte im Tabellenformat.

tesseract bild.png ausgabe tsv

Eine vollständige Dokumentenanalyse-Engine.

Erkennt nicht nur Zeichen, sondern auch Dokumentenlayout, Typografie und Struktur.

Engine-Architektur

Deep Learning mit LSTM

Modernes Tesseract (v5+) nutzt rekurrente neuronale LSTM-Netzwerke für höchste Erkennungsgenauigkeit. Textzeilen werden als kontinuierliche Sequenzen verarbeitet, wodurch der Kontext verstanden und typische Fehler minimiert werden.

Über 100 Sprachen

Fertige Modelle für lateinische, kyrillische, arabische, CJK- und indische Schriften. Beliebig umschaltbar oder mehrsprachig kombinierbar.

Erstellung durchsuchbarer PDFs

Konvertieren Sie große Stapel von TIFF- oder JPG-Bildern in PDF-Dateien mit unsichtbarem, durchsuchbarem Text direkt über dem Scan.

Eigene Modelle trainieren

Passen Sie das neuronale Netz mit dem offiziellen tesstrain Repository für eigene Schriftarten oder historische Dokumente an.

Engine-Modi (OEM)

Wechseln Sie zwischen der klassischen regelbasierten Engine und dem schnellen neuronalen LSTM-Netzwerk.

Detaillierte Layoutanalyse

Exportieren Sie Daten als hOCR oder ALTO mit genauen Bounding Boxes, Schriftstilen und Konfidenzwerten für jedes Wort.

Leistungs- und Genauigkeitsbenchmarks.

Empirische Messwerte für Tesseract v5 bei unterschiedlichen Bildauflösungen und Qualitätsstufen.

Eingangsauflösung Zeichengenauigkeit Verarbeitungszeit Empfohlener Einsatzzweck
150 DPI ~88.5% Schnell (~0.8s) Nur für Entwürfe und Vorschauen
300 DPI 99.2% Optimal (~1.2s) Standard für Dokumentenscans
600 DPI 99.7% Langsam (~3.5s) Hochpräzise Archivierung

Hinweis zur Genauigkeit: Diese Werte wurden mit dem LSTM-Modell auf sauberem, gedrucktem Text gemessen. Offizielle Testberichte ansehen →

Fundiert auf Jahrzehnten akademischer Forschung.

Tesseract ist ein Meilenstein der Computerlinguistik. Seine Architektur basiert auf wissenschaftlich fundierten Arbeiten.

  • Ray Smith (2007): "An Overview of the Tesseract OCR Engine" — Grundlegendes Paper zu Layoutanalyse und Worterkennung.
  • Ray Smith (1994): "A Comparison of Tesseract and Other OCR Systems" — Historische Vergleichsstudie.
  • Automatisierung in der Praxis.

    Tesseract bildet das Rückgrat automatisierter Datenverarbeitung in führenden Industriezweigen.

    42,50 €
    { "gesamt": 42.50 }

    Finanz- & Belegautomatisierung

    Extrahiert Beträge, Daten und Rechnungspositionen aus abfotografierten Quittungen und Rechnungen.

    B-XY 1234

    Kennzeichenerkennung (ANPR)

    Für Parkraumbewirtschaftung, Zufahrtskontrollen und intelligente Verkehrsüberwachung.

    Identitätsprüfung & KYC

    Beschleunigt Onboarding-Prozesse durch Auslesen von Personalausweisen, Pässen und Führerscheinen.

    PDF

    Massendigitalisierung

    Verwandeln Sie Millionen gescannter Bibliotheks- und Archivseiten in vollständig durchsuchbare PDFs.

    Unterstützte Sprachen in Tesseract OCR

    Tesseract unterstützt nativ über 100 Sprachen. Suchen Sie unten nach Ihrer Sprache und laden Sie das .traineddata Modell direkt herunter.

    Anwendung: Speichern Sie die Datei .traineddata im Verzeichnis TESSDATA_PREFIX und führen Sie aus: tesseract bild.png ausgabe -l deu Für mehrere Sprachen gleichzeitig: tesseract bild.png ausgabe -l deu+eng+fra

    Grafische Oberflächen (GUI) für Tesseract

    Tesseract ist eine CLI-Engine. Für den Desktop gibt es jedoch hervorragende grafische Programme aus der Open-Source-Community.

    Anwendung Plattform Lizenz Bester Einsatzzweck
    gImageReader Windows, Linux Kostenlos Dokumentenverarbeitung mit manueller Layoutanpassung
    Capture2Text Windows Kostenlos Schnelle Texterkennung per Screenshot und Tastaturkürzel
    NAPS2 Windows, Mac, Linux Kostenlos Dokumentenscan mit automatischer OCR-Texterkennung
    FreeOCR Windows Kostenlos Einfaches und klassisches Desktop-Werkzeug
    Tesseract-UI / Normcap Mac, Windows, Linux Kostenlos Plattformübergreifende Screenshot-Texterkennung per Drag & Drop
    Hinweis: Die Genauigkeit hängt von der installierten Tesseract-Version ab. Wir empfehlen Tesseract v5-kompatible Frontends.

    Seitensegmentierungsmodi (PSM)

    Dokumente haben unterschiedlichste Layouts. Tesseract bietet 14 Segmentierungsmodi zur optimalen Erkennung.

    • PSM 3: Vollautomatische Seitensegmentierung, ohne OSD (Standard).
    • PSM 6: Einheitlicher Textblock. Ideal für Buchseiten und Artikel.
    • PSM 11: Sparsamer Text. Findet so viel Text wie möglich ohne feste Reihenfolge.

    [ OCR-REGION ERKANNT ]
    pipeline.py
    import pytesseract
    from PIL import Image
    
    def dokument_erkennen(pfad):
        img = Image.open(pfad)
        return pytesseract.image_to_string(img, lang='deu')
    
    extrahierter_text = dokument_erkennen('rechnung.jpg')
    print(extrahierter_text)

    Tesseract OCR in Python integrieren

    Als kompilierte C/C++ Bibliothek, die auf allen großen Plattformen verfügbar ist, verfügt Tesseract über ein riesiges Ökosystem an Schnittstellen.

    Ob Backend mit tesseract.js in Node.js, Datenpipeline mit pytesseract in Python oder performanter Microservice mit gosseract in Go – die Einbindung gelingt in wenigen Zeilen Code.

    Warum Tesseract OCR einzigartig ist.

    Tesseract meistert die komplexe Umwandlung von Pixeln in lesbaren Text mit maximaler Zuverlässigkeit.

    100 % Gratis und Open Source.

    Keine Token, keine API-Schlüssel, keine Limits. Verarbeiten Sie 1 Seite oder 10 Millionen Seiten ohne Kosten.

    Standardmäßig Offline.

    Absoluter Datenschutz. Ihre Dokumente verlassen niemals Ihre Infrastruktur. Konform für Medizin-, Rechts- und Finanzdaten.

    Unterstützt durch Leptonica.

    Integrierte Bildverarbeitung mit Leptonica für automatische Binarisierung, Skalierung und Entrauschung.

    Kontinuierliche Weiterentwicklung.

    1985 bei HP gestartet, 2005 von Google als Open Source veröffentlicht und von einer weltweiten Community aktiv gepflegt.

    Hardwareunabhängig.

    Läuft auf Raspberry Pi ebenso wie auf Standard-Webservern oder Multi-Core-Clustern mit OpenMP-Beschleunigung.

    Ausrichtungs- & Schrifterkennung.

    Erkennt automatisch Ausrichtung und Schriftsystem von Dokumenten (OSD-Modus) und passt den OCR-Prozess dynamisch an.

    Häufig gestellte Fragen zu Tesseract OCR.

    Was macht Tesseract OCR in der Praxis?

    Tesseract wandelt Bilder mit Text (wie Rechnungen, Quittungen und gescannte Dokumente) in maschinenlesbaren, durchsuchbaren und bearbeitbaren Text um. Es dient als Kerntechnologie für Tausende Automatisierungs- und Scan-Anwendungen weltweit.

    Ist Tesseract OCR für die kommerzielle Nutzung kostenlos?

    Ja! Tesseract OCR steht unter der Apache-2.0-Lizenz zu 100 % kostenlos und quelloffen zur Verfügung. Sie können es ohne Lizenzkosten in privaten, akademischen und kommerziellen Projekten einsetzen.

    Ist Tesseract OCR im Jahr 2026 immer noch konkurrenzfähig?

    Absolut. Seit Version 4 und den Verfeinerungen in Version 5 nutzt Tesseract neuronale LSTM-Netzwerke, die bei gedruckten Dokumenten mit teuren Cloud-Diensten mithalten können – bei vollem Datenschutz und vollständiger Offline-Funktionalität.

    Gilt Tesseract OCR als Künstliche Intelligenz?

    Ja. Während frühere Versionen (v3) auf klassischem Mustervergleich basierten, setzt das moderne Tesseract (v4 und v5) auf rekurrente neuronale LSTM-Netzwerke (Deep Learning), die speziell für sequentielle Textdaten entwickelt wurden.

    Was ist der Unterschied zwischen Tesseract v4 und v5?

    Tesseract 5 bietet eine deutlich höhere Verarbeitungsgeschwindigkeit bei unverändert hoher Genauigkeit der LSTM-Modelle. Zudem wurden Speicherlecks behoben und das Modelltraining modernisiert. Es ist die empfohlene Version für den Produktiveinsatz.

    Bietet Tesseract eine grafische Benutzeroberfläche (GUI)?

    Nicht ab Werk. Tesseract ist eine C/C++ Bibliothek und ein Kommandozeilenwerkzeug. Für grafische Oberflächen können Sie Open-Source-Tools wie gImageReader, NAPS2 oder Capture2Text nutzen.

    Funktioniert Tesseract OCR direkt im Webbrowser?

    Ja. Projekte wie tesseract.js kompilieren den C++ Code nach WebAssembly (WASM). Dadurch läuft die Texterkennung direkt im Browser des Nutzers ohne jegliche Serverübertragung.

    Wie trainiert man Tesseract für eigene Schriftarten?

    Über das offizielle tesstrain Repository. Dieses Makefile-basierte Framework automatisiert die Generierung von Trainingsdaten und das Fine-Tuning bestehender .traineddata Modelle.

    Warum liefert Tesseract manchmal fehlerhafte Zeichen?

    Tesseract benötigt Bilder mit gutem Kontrast und ausreichender Schärfe. Bei verrauschten oder schiefen Scans empfiehlt sich eine Vorverarbeitung (Binarisierung, Entzerrung) mit OpenCV oder Pillow vor der Texterkennung.

    Welche Bildformate unterstützt Tesseract OCR?

    Unterstützt werden PNG, JPEG, TIFF, BMP, PNM, GIF und WebP über die Leptonica-Bibliothek. Für optimale Ergebnisse empfehlen sich verlustfreie Formate wie TIFF oder PNG mit 300 DPI oder höher.

    Wie hoch ist die Erkennungsgenauigkeit von Tesseract OCR?

    Bei sauberen Scans in 300 DPI erreicht Tesseract v5 über 95 % Genauigkeit pro Zeichen und bei klarem Standarddruck oft mehr als 99 %. Bildvorverarbeitung verbessert die Ergebnisse bei schwierigen Vorlagen erheblich.

    Läuft Tesseract OCR vollständig offline?

    Ja. Tesseract arbeitet 100 % lokal und offline. Es überträgt keinerlei Daten an externe Server – ideal für datenschutzsensible Umgebungen in Medizin, Verwaltung und Finanzwesen.

    Tesseract OCR vs. Google Cloud Vision API: Was ist besser?

    Tesseract OCR ist kostenlos, Open Source und 100 % offline – perfekt, wenn Datenschutz und Unabhängigkeit im Vordergrund stehen. Cloud-APIs wie Google Cloud Vision bieten Vorteile bei komplexer Handschrift, verursachen jedoch laufende Kosten und erfordern Serverübertragungen.

    Wie kann ich die Genauigkeit von Tesseract OCR verbessern?

    Der wichtigste Hebel ist die Bildvorverarbeitung:

    • Auf mindestens 300 DPI skalieren — Tesseract benötigt ausreichend große Buchstaben.
    • Binarisierung — In Graustufen umwandeln und Otsu-Schwellenwert für klares Schwarz-Weiß anwenden.
    • Entzerrung (Deskew) — Bilddrehungen vorab korrigieren.
    • Rauschunterdrückung — Median-Filter gegen Flecken und Körnung einsetzen.
    • Passenden PSM-Modus wählen — z. B. --psm 6 für Textblöcke oder --psm 7 für einzelne Zeilen.
    • Richtiges Sprachmodell angeben — z. B. -l deu für Deutsch oder -l deu+eng für bilinguale Dokumente.
    Welche modernen Deep-Learning-Alternativen zu Tesseract gibt es?

    Ergänzend zu Tesseract gibt es spezialisierte Open-Source-Frameworks:

    • PaddleOCR: Deep-Learning-OCR-Framework (PP-OCRv6) mit hervorragender Tabellenerkennung und Unterstützung für gekrümmten Text.
    • Docling: Dokumentenparser für Generative AI und RAG, der PDFs und Bilder in strukturiertes Markdown und JSON umwandelt.

    Bereit zur Textextraktion?

    In einem einzigen Befehl zu einer vollständigen OCR-Pipeline.

    $ tesseract scan.png stdout -l deu