メインコンテンツへスキップ
オープンソースの伝統

コミュニティが支え、
AIが駆動する。

Tesseract OCRは単なるソフトウェアではありません。人類の印刷された知識を、機械と人間双方が自由にアクセスできるようにするための世界的な共同プロジェクトです。

私たちの使命 (Our Mission)

高品質な文字認識技術は公共の財産であるべきだと私たちは信じています。高性能サーバーからスマートフォン、Webブラウザに至るまで、あらゆる場所で100%無料かつプライバシー安全に利用できるOCRエンジンを提供し続けます。

  • プライバシー第一: データはお使いのマシン内にとどまり、外部サーバーへ送信されることはありません。
  • 普遍的なアクセス: 100以上の言語と文字体系をサポートし、世界中のデジタルデバイドを解消します。
  • Web対応: インストール不要の オンラインOCRデモ で即座に文字認識を体験できます。
COMMUNITY DRIVEN

Tesseractの歩み (Timeline)

1980年代の研究開発から、世界で最も利用されるオープンソースOCRエンジンへの進化

1985 — 1994

HP研究所での誕生

英国ブリストルおよび米国コロラド州のHewlett-Packard研究所で独自開発。当時最も精度の高いOCRエンジンの一つとして評価されました。

2005 — 2018

Googleによるオープンソース化と後援

Googleが2005年にオープンソースとして公開し、10年以上にわたり開発を支援。バージョン4で画期的なLSTMニューラルネットワークが統合されました。

2019 — 現在

コミュニティ主導の進化

現在は世界中の開発者コミュニティによって活発にメンテナンスされ、2026年現在もオープンソース文字認識の最高峰であり続けています。

「Tesseract」の名前の由来

4次元超立方体(テッセラクト)を意味します。テッセラクトが立方体に新しい次元を加えるように、当エンジンは静止画像に「構造化されたテキスト」という実用的な新しい次元を与えます。

コミュニティに参加する

C++開発者、学習データを改善する言語専門家、ドキュメント執筆者など、あらゆるコントリビューターを歓迎しています。

GitHubで参加する