Релиз системы распознавания текста Tesseract 5.4.0
- С сайта: OpenNet
- Вернуться к списку новостей
Релиз системы распознавания текста Tesseract 5.4.0
Author:Опубликован релиз системы оптического распознавания текста Tesseract 5.4.0, поддерживающей распознавание символов UTF-8 и текстов на более чем 100 языках, включая русский, казахский, белорусский и украинский. Результат может сохраняться как открытым текстом, так и в форматах HTML (hOCR), ALTO (XML), PDF и TSV. Изначально система была создана в 1985-1995 годах в лаборатории компании Hewlett Packard, в 2005 году код был открыт под лицензией Apache и в дальнейшем развивался при участии работников компании Google. Исходные тексты проекта распространяются под лицензией Apache 2.0.
#csn #cyber_news
Оригинальная версия на сайте: