Логотип Soware

Описание системы Tesseract OCR

Информация о Tesseract OCR

Подходит для
Специалист
Развёртывание
Персональный компьютер, Сервер предприятия
Графический интерфейс
Windows, Linux, macOS
Тарификация
Бесплатно
Поддержка языков
Иврит, Эстонский, Португальский, Монгольский, Болгарский, Сербский, Русский, Казахский, Китайский, Латвийский, Норвежский, Турецкий, Татарский, Кхмерский, Азербайджанский, Белорусский, Венгерский, Хинди, Польский, Финский, Немецкий, Нидерландский, Японский, Фарси, Французский, Арабский, Вьетнамский, Литовский, Индонезийский, Английский, Греческий, Бенгальский, Шведский, Испанский, Чешский, Украинский, Корейский, Хорватский, Персидский, Итальянский, Датский, Каталонский
Реестр российского ПО
Не включен
Демо версия
ДаДа
Пробная версия (триал)
Нет
Свободное ПО
Да

Краткий обзор Tesseract OCR

Tesseract — это программный движок с открытым исходным кодом, позволяющий распознавать символы с поддержкой кодировки Unicode и возможностью распознавания более 130 языков, а также с возможностью дополнения для распознавания других языков.

Программное решение Tesseract (рус. Тессеракт) с открытым исходным кодом от компании Google предназначено для распознавания текста (англ. OCR). Программа распространяется бесплатно и доступна для использования по лицензии Apache 2. 0.

Программное обеспечение Tesseract может быть использовано непосредственно или при помощи API, позволяя извлекать печатный текст из изображений.

Программный движок Tesseract не имеет встроенного графического интерфейса (GUI), но есть несколько доступных вариантов графического интерфейса от третьих сторон. Система поддерживает широкий спектр языков для распознавания — более 130.

Подробнее: https://opensource.google/projects/tesseract

Знак признания Tesseract OCR

Вы из команды Tesseract OCR?

Покупатели приходят сюда, чтобы решить, выбрать Ваш продукт или нет. Хотите улучшить профиль?

Запросить расширенное размещение

Функции

НетАдминистрирование
НетИнтеллектуальные возможности (ИИ)
ДаНаличие API
НетОбработка звуковых данных
НетКластеризация
НетКлассификация данных
НетИнтеграция данных
НетИнтеллектуальный анализ данных
НетМониторинг данных
НетВизуализация данных
НетДообучение
ДаИмпорт/экспорт данных
ДаМашинное обучение
НетМногопользовательский доступ
НетПрогнозирование
НетОптимизация процессов
НетОтчётность и аналитика
НетОбработка структурированных данных
НетПоддержка ограничений по слуху
НетПоддержка ограничений по зрению
ДаОбработка текстовых данных
НетОбработка видео-данных
ДаОбработка визуально-графических данных
НетОбработка голосовых данных

Разработчик системы Tesseract OCR

Компания-разработчик:

Google

Веб-сайт (продукт):

https://opensource.google/projects/tesseract

Страна:

США

Веб-сайт:

https://about.google/intl/ru_ru/

Головной офис:

Маунтин-Вью, Калифорния

Вопросы и ответы Tesseract OCR

?

Поддерживает ли Tesseract OCR работу с защищёнными (зашифрованными) документами и как это реализовано?

Tesseract OCR не имеет встроенных механизмов для работы с защищёнными (зашифрованными) документами, требуется дополнительное ПО для расшифровки данных перед распознаванием.

?

Какие методы предобработки изображений можно использовать с Tesseract OCR для повышения качества распознавания?

Для повышения качества распознавания с Tesseract OCR можно использовать методы предобработки изображений, такие как улучшение контраста, удаление шума, бинаризация.

?

Есть ли у Tesseract OCR встроенные механизмы для обработки рукописного текста и насколько они эффективны?

Tesseract OCR имеет ограниченные возможности для обработки рукописного текста, эффективность распознавания в таких случаях ниже, чем для печатного текста.

?

Поддерживает ли Tesseract OCR многоязычное распознавание, и какие языки доступны?

Tesseract OCR поддерживает многоязычное распознавание, доступно более 130 языков.

?

Какие форматы изображений поддерживает Tesseract OCR для распознавания текста?

Tesseract OCR поддерживает различные форматы изображений, включая распространённые, такие как PNG, JPEG, TIFF.

?

Предполагает ли Tesseract OCR серверный вариант установки (или на частное облако)?

Нет, Tesseract OCR не может быть развёрнуто на собственных серверах организации.

?

Каковы возможности кастомизации и настройки алгоритмов распознавания в Tesseract OCR?

Возможности кастомизации Tesseract OCR включают настройку параметров распознавания и добавление языковых пакетов, что позволяет адаптировать систему под специфические задачи.

?

На каких операционных системах можно использовать Tesseract OCR?

Программный продукт Tesseract OCR может быть использован на следующих операционных системах: .

Популярные аналоги Tesseract OCR

Логотип

Медиалогия SM

Медиалогия

Медиалогия SM — это облачная система аналитики и мониторинга социальных медиа, которая собирает и анализирует данные из 4 млрд источников соцмедиа: соцсети, видео-платформы, маркетплейсы, отзовики, блоги и форумы, карты и мобильные приложения, мессенджеры и интернет-СМИ. Система обрабатывает тексты, изображения, геолокации, логотипы, видео, и по итогам анализа формирует подробный отчёт

Логотип

Медиалогия PR

Медиалогия

Медиалогия PR — это цифровой инструмент оперативного мониторинга и анализа СМИ. Более 110 000 активных источников в системе: ТВ, радио, информагентства, газеты, журналы, интернет-СМИ, включая закрытые новостные ленты, PDF и видео-материалы из первоисточников

Логотип

PolyAnalyst

Мегапьютер Интеллидженс

Megaputer PolyAnalyst — это российская low-code платформа визуальной разработки сценариев анализа данных и текстовых документов, а также построения интерактивных отчётов, не требующая навыков программирования

МТС Облачное видеонаблюдение — это онлайн-сервис, включающий 11 модулей видеоаналитики, для организации интеллектуального наблюдения за автомобилями, пассажирами, сотрудниками и иными рабочими объектами

Инлексис Голосовой бот — это интеллектуальный сервис для эффективного обзвона клиентов, позволяющий крупному бизнесу экономить миллионы рублей на сокращении операционных расходов

Логотип

Медиалогия IM

Медиалогия

Медиалогия IM — это единый контур для обработки отзывов и жалоб из внешних источников с контролем сроков ответа (SLA), маршрутизации и качества ответа