Lompat ke konten utama
Warisan Open Source

Digerakkan Komunitas,
Ditenagai AI.

Tesseract OCR bukan sekadar perangkat lunak; ini adalah gerakan kolaboratif global untuk membuat seluruh pengetahuan cetak manusia dapat diakses bebas oleh mesin dan manusia.

Misi Kami (Our Mission)

Kami meyakini bahwa teknologi pengenalan karakter optik berkualitas tinggi harus menjadi barang publik yang dapat diakses siapa saja. Dari server besar hingga ponsel pintar dan browser web, kami berkomitmen menghadirkan solusi OCR yang 100% gratis, offline, dan menjaga privasi.

  • Privasi Utama: Dokumen dan data Anda tetap berada di perangkat lokal Anda, bebas dari kebocoran ke cloud.
  • Akses Universal: Mendukung lebih dari 100 bahasa dan sistem aksara untuk meruntuhkan batasan digital.
  • Siap untuk Web: Coba fitur tanpa instalasi di OCR Online untuk konversi instan.
COMMUNITY DRIVEN

Linimasa Sejarah (Timeline)

Dari riset laboratorium tahun 1980-an hingga menjadi standar OCR open source paling terpercaya di dunia

1985 — 1994

Lahir di HP Labs

Dikembangkan di laboratorium Hewlett-Packard di Bristol (Inggris) dan Colorado (AS), menjadi salah satu mesin OCR komersial terbaik pada masanya.

2005 — 2018

Dukungan Google & Open Source

Dirilis sebagai open source oleh Google pada 2005 dan dikembangkan selama lebih dari satu dekade. Versi 4 memperkenalkan neural network LSTM revolusioner.

2019 — Sekarang

Dikelola Komunitas Global

Kini dikelola secara aktif oleh komunitas pengembang independen di seluruh dunia, terus memimpin inovasi OCR open source.

Makna Nama "Tesseract"

Tesseract adalah sebutan untuk hiperkubus 4 dimensi. Sebagaimana hiperkubus memberikan dimensi baru pada kubus, mesin Tesseract memberikan dimensi baru berupa teks terstruktur pada gambar statis.

Bergabung dengan Komunitas

Pengembang C++, pelatih model bahasa, dan penulis dokumentasi selalu kami sambut dengan hangat!

Kontribusi di GitHub