Search
Write a publication
Pull to refresh
16
0
Вячеслав Сапроненко @SlaSapro

Разработчик, пишу на C++

Send message

Укрощение строптивого (на самом деле, нет) FineReader

Reading time7 min
Views46K

После короткого рассказа о том, как устроен ABBYY FineReader (aka «теоретическая часть»), самое время перейти к применению полученных знаний. И да, котиков под катом нет: всё очень серьёзно.

Как пользователю поучаствовать в обработке документа


Чтобы не изобретать велосипед, начну с простой и понятной схемы из Справки (см. рисунок справа).

Теперь, зная список всех операций, посмотрим на примерах – что может пойти не по плану и как с этим бороться.
Читать дальше →

На пути к профессиональному использованию современных OCR. Understanding FineReader

Reading time7 min
Views11K
Я занимаюсь разработкой технологий, используемых в продуктах распознавания текста компании ABBYY. Самым известным продуктом (а точнее – семейством продуктов), использующим эти технологии, является FineReader.

Что я понимаю под «технологиями»
Иногда все технологические модули (невидимые пользователю части программы) вместе называют «движком распознавания» («движок» — от английского «Engine»), что не совсем верно – они выполняют не только распознавание символов, но и кучу других действий, подробнее о которых ниже.


Чем занимается программа FineReader?


Сейчас любой из настольных вариантов FineReader может проделать все самостоятельно от получения изображения со сканера, камеры или из готового файла до выдачи результата обработки в файл или в указанное приложение, так, что человек остается «за кадром». Программа сама «распознаёт» всё что нужно (в кавычках, так как при этом программа определяет места расположения текста, таблиц, картинок, OCRит обнаруженные участки с изображённым текстом, формирует документ, который сохраняет в желаемом формате с указанными настройками)
Пара скриншотов




А чем занимается пользователь?


Читать дальше →

Information

Rating
Does not participate
Location
Сергиев Посад, Москва и Московская обл., Россия
Works in
Date of birth
Registered
Activity