Логотип Soware

Описание системы Tesseract OCR

Информация о Tesseract OCR

Подходит для
Специалист
Развёртывание
Сервер предприятия, Персональный компьютер
Графический интерфейс
macOS, Windows, Linux
Тарификация
Бесплатно
Поддержка языков
Иврит, Эстонский, Португальский, Монгольский, Болгарский, Сербский, Русский, Казахский, Китайский, Латвийский, Норвежский, Турецкий, Татарский, Кхмерский, Азербайджанский, Белорусский, Венгерский, Хинди, Польский, Финский, Немецкий, Нидерландский, Японский, Фарси, Французский, Арабский, Вьетнамский, Литовский, Индонезийский, Английский, Греческий, Бенгальский, Шведский, Испанский, Чешский, Украинский, Корейский, Хорватский, Персидский, Итальянский, Датский, Каталонский
Реестр российского ПО
Не включен
Демо версия
ДаДа
Пробная версия (триал)
Нет
Свободное ПО
Да

Краткий обзор Tesseract OCR

Tesseract — это программный движок с открытым исходным кодом, позволяющий распознавать символы с поддержкой кодировки Unicode и возможностью распознавания более 130 языков, а также с возможностью дополнения для распознавания других языков.

Программное решение Tesseract (рус. Тессеракт) с открытым исходным кодом от компании Google предназначено для распознавания текста (англ. OCR). Программа распространяется бесплатно и доступна для использования по лицензии Apache 2.0.

Программное обеспечение Tesseract может быть использовано непосредственно или при помощи API, позволяя извлекать печатный текст из изображений.

Программный движок Tesseract не имеет встроенного графического интерфейса (GUI), но есть несколько доступных вариантов графического интерфейса от третьих сторон. Система поддерживает широкий спектр языков для распознавания — более 130.

Подробнее: https://opensource.google/projects/tesseract

Знак признания Tesseract OCR

Информация проверена

Соваре, ИИ-агент проверки: 14.07.2025
Соваре, Аналитик-эксперт: 14.07.2025
--.--.----

Функции

НетМногопользовательский доступ
ДаНаличие API
НетОтчётность и аналитика
ДаИмпорт/экспорт данных
НетАдминистрирование
НетИнтеллектуальный анализ данных
ДаМашинное обучение
НетДообучение
НетОбработка структурированных данных
ДаОбработка текстовых данных
НетОбработка звуковых данных
НетОбработка голосовых данных
ДаОбработка визуально-графических данных
НетОбработка видео-данных
НетКлассификация данных
НетПрогнозирование
НетКластеризация
НетИнтеграция данных
НетМониторинг данных
НетОптимизация процессов
НетВизуализация

Разработчик системы Tesseract OCR

Компания-разработчик:

Google

Веб-сайт (продукт):

https://opensource.google/projects/tesseract

Страна:

США

Веб-сайт:

https://about.google/intl/ru_ru/

Головной офис:

Маунтин-Вью, Калифорния

Вопросы и ответы Tesseract OCR

?

Поддерживает ли Tesseract OCR русский язык?

Да, Tesseract OCR поддерживает русский язык.

?

Какие API и интерфейсы предоставляет Tesseract OCR для взаимодействия с другими программными продуктами?

Tesseract OCR предоставляет API для взаимодействия с другими программными продуктами, что облегчает интеграцию в различные системы.

?

Какие есть варианты оплаты за использование Tesseract OCR?

Компанией Google предлагаются следующие варианты тарификации за Tesseract OCR: Бесплатно.

?

Поддерживает ли Tesseract OCR работу с защищёнными (зашифрованными) документами и как это реализовано?

Tesseract OCR не имеет встроенных механизмов для работы с защищёнными (зашифрованными) документами, требуется дополнительное ПО для расшифровки данных перед распознаванием.

?

Поддерживается ли в Tesseract OCR английский язык?

Да. В Tesseract OCR может быть использован английский язык интерфейса.

?

Существует ли дистрибутив Tesseract OCR под операционные системы семейства Linux?

Да, Tesseract OCR может быть развёрнута и использоваться на ОС Linux.

?

Насколько легко можно масштабировать Tesseract OCR для работы с большим количеством одновременных запросов?

Масштабирование Tesseract OCR для работы с большим количеством одновременных запросов возможно за счёт распределения нагрузки на серверные ресурсы и оптимизации инфраструктуры.

?

Есть ли у Tesseract OCR встроенные механизмы для обработки рукописного текста и насколько они эффективны?

Tesseract OCR имеет ограниченные возможности для обработки рукописного текста, эффективность распознавания в таких случаях ниже, чем для печатного текста.

Популярные аналоги Tesseract OCR

Логотип

Медиалогия SM

Медиалогия

Медиалогия SM — это облачная система аналитики и мониторинга социальных медиа, которая собирает и анализирует данные из 4 млрд источников соцмедиа: соцсети, видео-платформы, маркетплейсы, отзовики, блоги и форумы, карты и мобильные приложения, мессенджеры и интернет-СМИ. Система обрабатывает тексты, изображения, геолокации, логотипы, видео, и по итогам анализа формирует подробный отчёт.

Логотип

Медиалогия PR

Медиалогия

Медиалогия PR — это цифровой инструмент оперативного мониторинга и анализа СМИ. Более 110 000 активных источников в системе: ТВ, радио, информагентства, газеты, журналы, интернет-СМИ, включая закрытые новостные ленты, PDF и видео-материалы из первоисточников.

Логотип

PolyAnalyst

Мегапьютер Интеллидженс

Megaputer PolyAnalyst — это российская low-code платформа визуальной разработки сценариев анализа данных и текстовых документов, а также построения интерактивных отчётов, не требующая навыков программирования.

Инлексис Голосовой бот — это интеллектуальный сервис для эффективного обзвона клиентов, позволяющий крупному бизнесу экономить миллионы рублей на сокращении операционных расходов.

МТС Облачное видеонаблюдение — это онлайн-сервис, включающий 11 модулей видеоаналитики, для организации интеллектуального наблюдения за автомобилями, пассажирами, сотрудниками и иными рабочими объектами.

Логотип

Медиалогия IM

Медиалогия

Медиалогия IM — это единый контур для обработки отзывов и жалоб из внешних источников с контролем сроков ответа (SLA), маршрутизации и качества ответа.