Saltar al contenido principal
Patrimonio de Código Abierto

Impulsado por la comunidad.
Potenciado por IA.

Tesseract OCR es más que un motor de software; es un esfuerzo colaborativo global para hacer accesible el conocimiento impreso del mundo tanto a máquinas como a personas.

Nuestra Misión

Creemos que el reconocimiento de texto de alta calidad debe ser un bien público. Nuestra misión es proporcionar una solución de OCR líder en la industria, 100% gratuita y privada que funcione en todas partes: desde servidores de alto rendimiento hasta dispositivos móviles y navegadores web.

  • Privacidad Primero: Ningún dato sale de tu máquina. Tesseract opera 100% offline por defecto.
  • Acceso Universal: Soporte para más de 100 idiomas y docenas de alfabetos para reducir la brecha digital.
  • Listo para la Web: Experimenta Tesseract en tu navegador usando nuestra Demo de OCR Online sin instalación.
IMPULSADO POR LA COMUNIDAD

Cronología de Tesseract

De un proyecto de investigación en los años 80 al motor OCR de código abierto más popular del mundo.

1985 — 1994

Investigación en HP

Desarrollado originalmente como software propietario en los laboratorios de Hewlett-Packard en Bristol (Reino Unido) y Greeley (Colorado). Fue uno de los motores más precisos de su época.

2005 — 2018

La Era de Google

Google liberó Tesseract como código abierto en 2005 y patrocinó su desarrollo durante más de una década, introduciendo el revolucionario motor neuronal LSTM en la versión 4.

2019 — Presente

Liderazgo Comunitario

Hoy, Tesseract es mantenido por una activa comunidad global de desarrolladores. Continúa siendo el estándar de oro para el reconocimiento de caracteres en 2026.

¿Por qué "Tesseract"?

El nombre hace referencia a un hipercubo de cuatro dimensiones. Así como un teseracto añade una dimensión a un cubo, nuestro motor añade una dimensión de utilidad a las imágenes estáticas convirtiéndolas en datos estructurados y buscables.

Únete a la Comunidad

Siempre estamos buscando colaboradores: ya seas desarrollador en C++, lingüista que ayude con datos de entrenamiento o redactor de documentación.

Participar en GitHub