Por que "Tesseract"?
O nome refere-se a um hipercubo quadridimensional (tessseracto). Assim como um tesseract adiciona uma dimensão a um cubo, nosso motor adiciona utilidade a imagens estáticas transformando-as em dados pesquisáveis e estruturados.
O Tesseract OCR é mais do que um motor de software: é um esforço colaborativo global para tornar o conhecimento impresso do mundo acessível tanto para máquinas quanto para pessoas.
Acreditamos que o reconhecimento de texto de alta qualidade deve ser um bem público. Nossa missão é fornecer uma solução de OCR líder de mercado, 100% gratuita e privada, capaz de rodar em qualquer lugar: de servidores de alta performance a smartphones e navegadores web.
De um projeto de pesquisa na década de 1980 ao motor de OCR open source mais popular do planeta.
Desenvolvido originalmente como software proprietário nos laboratórios da Hewlett-Packard em Bristol (Reino Unido) e Greeley (Colorado). Foi um dos motores mais precisos de sua época.
O Google liberou o código-fonte do Tesseract em 2005 e patrocinou seu desenvolvimento por mais de uma década, introduzindo o revolucionário motor neural LSTM na versão 4.
Hoje, o Tesseract é mantido por uma vibrante comunidade global de desenvolvedores. Permanece como a referência absoluta para reconhecimento de caracteres em 2026.
O nome refere-se a um hipercubo quadridimensional (tessseracto). Assim como um tesseract adiciona uma dimensão a um cubo, nosso motor adiciona utilidade a imagens estáticas transformando-as em dados pesquisáveis e estruturados.
Estamos sempre em busca de novos colaboradores: sejam programadores em C++, linguistas para dados de treinamento ou redatores de documentação.
Colaborar no GitHub