Логотип Soware

Описание системы Tesseract OCR

Информация о Tesseract OCR

Подходит для
Специалист
Развёртывание
Персональный компьютер, Сервер предприятия
Графический интерфейс
Windows, Linux, macOS
Тарификация
Бесплатно
Поддержка языков
Иврит, Эстонский, Португальский, Монгольский, Болгарский, Сербский, Русский, Казахский, Китайский, Латвийский, Норвежский, Турецкий, Татарский, Кхмерский, Азербайджанский, Белорусский, Венгерский, Хинди, Польский, Финский, Немецкий, Нидерландский, Японский, Фарси, Французский, Арабский, Вьетнамский, Литовский, Индонезийский, Английский, Греческий, Бенгальский, Шведский, Испанский, Чешский, Украинский, Корейский, Хорватский, Персидский, Итальянский, Датский, Каталонский
Реестр российского ПО
Не включен
Демо версия
ДаДа
Пробная версия (триал)
Нет
Свободное ПО
Да

Краткий обзор Tesseract OCR

Tesseract — это программный движок с открытым исходным кодом, позволяющий распознавать символы с поддержкой кодировки Unicode и возможностью распознавания более 130 языков, а также с возможностью дополнения для распознавания других языков.

Программное решение Tesseract (рус. Тессеракт) с открытым исходным кодом от компании Google предназначено для распознавания текста (англ. OCR). Программа распространяется бесплатно и доступна для использования по лицензии Apache 2. 0.

Программное обеспечение Tesseract может быть использовано непосредственно или при помощи API, позволяя извлекать печатный текст из изображений.

Программный движок Tesseract не имеет встроенного графического интерфейса (GUI), но есть несколько доступных вариантов графического интерфейса от третьих сторон. Система поддерживает широкий спектр языков для распознавания — более 130.

Подробнее: https://opensource.google/projects/tesseract

Знак признания Tesseract OCR

Вы из команды Tesseract OCR?

Покупатели приходят сюда, чтобы решить, выбрать Ваш продукт или нет. Хотите улучшить профиль?

Запросить расширенное размещение

Функции

НетАдминистрирование
НетИнтеллектуальные возможности (ИИ)
ДаНаличие API
НетОбработка звуковых данных
НетКластеризация
НетКлассификация данных
НетИнтеграция данных
НетИнтеллектуальный анализ данных
НетМониторинг данных
НетВизуализация данных
НетДообучение
ДаИмпорт/экспорт данных
ДаМашинное обучение
НетМногопользовательский доступ
НетПрогнозирование
НетОптимизация процессов
НетОтчётность и аналитика
НетОбработка структурированных данных
НетПоддержка ограничений по слуху
НетПоддержка ограничений по зрению
ДаОбработка текстовых данных
НетОбработка видео-данных
ДаОбработка визуально-графических данных
НетОбработка голосовых данных

Разработчик системы Tesseract OCR

Компания-разработчик:

Google

Веб-сайт (продукт):

https://opensource.google/projects/tesseract

Страна:

США

Веб-сайт:

https://about.google/intl/ru_ru/

Головной офис:

Маунтин-Вью, Калифорния

Вопросы и ответы Tesseract OCR

?

Поддерживает ли Tesseract OCR работу с защищёнными (зашифрованными) документами и как это реализовано?

Tesseract OCR не имеет встроенных механизмов для работы с защищёнными (зашифрованными) документами, требуется дополнительное ПО для расшифровки данных перед распознаванием.

?

На каких операционных системах можно использовать Tesseract OCR?

Программный продукт Tesseract OCR может быть использован на следующих операционных системах: .

?

Поддерживает ли Tesseract OCR русский язык?

Да, Tesseract OCR поддерживает русский язык.

?

Какие языки поддерживает Tesseract OCR?

Tesseract OCR поддерживает в своём интерфейсе следующие языки: Русский, Английский, Азербайджанский, Белорусский, Арабский, Бенгальский, Болгарский, Венгерский, Вьетнамский, Греческий, Датский, Иврит, Индонезийский, Испанский, Итальянский, Казахский, Каталонский, Китайский, Корейский, Кхмерский, Латвийский, Литовский, Немецкий, Монгольский, Нидерландский, Норвежский, Персидский, Польский, Португальский, Сербский, Украинский, Турецкий, Татарский, Фарси, Французский, Финский, Хинди, Чешский, Хорватский, Шведский, Эстонский, Японский.

?

Предполагает ли Tesseract OCR серверный вариант установки (или на частное облако)?

Нет, Tesseract OCR не может быть развёрнуто на собственных серверах организации.

?

Как Tesseract OCR справляется с распознаванием текста на сложных фонах или в условиях сильного шума изображения?

Tesseract OCR использует алгоритмы для улучшения распознавания текста на сложных фонах и в условиях шума, но результаты зависят от степени сложности изображения.

?

Поддерживается ли в Tesseract OCR английский язык?

Да. В Tesseract OCR может быть использован английский язык интерфейса.

?

Какие существуют варианты установки Tesseract OCR?

Система Tesseract OCR может быть установлена на: Сервер предприятия, Персональный компьютер.

Популярные аналоги Tesseract OCR

Логотип

Медиалогия SM

Медиалогия

Медиалогия SM — это облачная система аналитики и мониторинга социальных медиа, которая собирает и анализирует данные из 4 млрд источников соцмедиа: соцсети, видео-платформы, маркетплейсы, отзовики, блоги и форумы, карты и мобильные приложения, мессенджеры и интернет-СМИ. Система обрабатывает тексты, изображения, геолокации, логотипы, видео, и по итогам анализа формирует подробный отчёт

Логотип

Медиалогия PR

Медиалогия

Медиалогия PR — это цифровой инструмент оперативного мониторинга и анализа СМИ. Более 110 000 активных источников в системе: ТВ, радио, информагентства, газеты, журналы, интернет-СМИ, включая закрытые новостные ленты, PDF и видео-материалы из первоисточников

Логотип

PolyAnalyst

Мегапьютер Интеллидженс

Megaputer PolyAnalyst — это российская low-code платформа визуальной разработки сценариев анализа данных и текстовых документов, а также построения интерактивных отчётов, не требующая навыков программирования

Инлексис Голосовой бот — это интеллектуальный сервис для эффективного обзвона клиентов, позволяющий крупному бизнесу экономить миллионы рублей на сокращении операционных расходов

МТС Облачное видеонаблюдение — это онлайн-сервис, включающий 11 модулей видеоаналитики, для организации интеллектуального наблюдения за автомобилями, пассажирами, сотрудниками и иными рабочими объектами

ФАРАДЕЙ ИИ — это корпоративный ИИ-сотрудник для документов, знаний и аналитики. Прикладная AI-платформа, которая использует корпоративные LLM-модели (в т.ч. российские) и не требует передачи данных внешним сервисам