Обновить
32K+
85

Пользователь

60,8
Рейтинг
183
Подписчики
Отправить сообщение

Добрый день! 

Все зависит от банковского продукта. Например, для осуществления денежного перевода от вас не потребуется ничего кроме паспорта. А для оформления кредита нужны паспорт, анкета, а также справка о доходах физлица (ранее 2-НДФЛ), которая в свою очередь «рисуется» элементарно. Поэтому, безусловно, панацеи нет, однако есть способы уменьшения боли.

Кроме того, может быть, вы не знали, но есть довольная распространенная практика – накрутка кредитного рейтинга. В этом случае мошенники по поддельному паспорту берут несколько маленьких кредитов и возвращают их, наращивая таким образом кредитный рейтинг, а затем берут уже крупную сумму денег и просто исчезают.

Добрый день! Благодарим за интерес к материалу.

1. Длины слов V и W - это |V| и |W|, соответственно. i  и j - это индексы от 0 до длины соответствующей строки.

2. Другим способом вычисления расстояния между словами является применение расстояния мультимножества. Если задан набор кодов всех возможных символов (алфавит), то любое слово можно представить в виде мультимножества, носителем которого является алфавит. Слово в виде мультимножества представляет собой не матрицу, а вектор. В этом векторе значение 0 в некоторой компоненте означает отсутствие соответствующего символа в слове. А ненулевая компонента – сколько раз символ присутствующих в слове. Расстояние (метрика) мультимножества для двух слов вычисляется как сумма абсолютных значений разностей значений компонент двух описанных векторов. Действительно, Это - стандартный подход к сравнению слов. Однако при применении метрики мультимножества оказываются идентичными слова с перестановками символов. Например, по этой метрики идентичны все слова: XYZ, XZY, YXZ, YZX, ZXY, ZYX.

Если Вы можете написать формулы для оценки близости слов с помощью сингулярного разложения матриц, мы можем обсудить эту идею подробно. Нам такой подход неизвестен.

Добрый день! Большое спасибо за ваш вопрос.

Отличие технологии контролируемой томографической реконструкции от низкодозовой компьютерной томографии (НДКТ) заключается в самом протоколе проведения томографического исследования.

В НДКТ протокол проведения исследования такой. Заранее заданное (фиксированное) количество томографических проекций снимается при “низкодозовом” режиме источника рентгеновского излучения, в измерительной схеме, минимизирующей дозовую нагрузку на каждый локальный объем зондируемого объекта. После того, как все проекции зарегистрированы, выполняется реконструкция цифрового изображения объекта. Качество такого изображения гораздо хуже, чем при съемке в “полнодозовом” режиме. На протяжении нескольких десятков лет после предложения использовать НДКТ ведется разработка специализированных алгоритмов реконструкции, способных повысить качество цифрового изображения, реконструированного из проекций при использовании “низкодозового” режима съемки. Если пролистать научные публикации, вышедшие в текущем году, то можно найти не одну работу на эту тему.

В предложенной нами технологии контролируемой томографической реконструкции использован иной подход. Перед началом съемки проекций мы не знаем, сколько проекций будет снято. Решение об окончании съемки принимается мониторинговой системой автоматически. Реконструкция цифрового изображения выполняется каждый раз после съемки очередной серии проекций. Если мониторинговая система сообщает о достижении требуемой точности реконструкции, съемка останавливается.

Решение об окончании съемки может быть принято в одном из трех случаев: достигнута требуемая точность реконструкции, “что-то пошло не так” или достигнут предел по дозовой нагрузке. “Что-то пошло не так” может означать сбой в работе оборудования или движение пациента, но главное – проблемный момент будет зафиксирован и сбор проекций будет остановлен в этот момент.

Ранее, если точность восстановленного изображения была признана недостаточной из-за наличия незадетектированных вовремя проблем, приходилось переснимать все проекции целиком, т.е. удваивать радиационную нагрузку.

Обратите внимание, что в нашей новой технологии все преимущества НДКТ (оптимизированные режим источника и измерительная схема) могут использоваться, при этом дозовая нагрузка может еще сократиться.

Добрый день! Благодарим за интерес к нашей публикации.

X-ray - это тип зонда, т.е. светят рентгеном. Рентгеновская компьютерная томография - это метод изучения внутренней структуры, в котором цифровое изображение внутренней структуры трехмерного исследуемого объема восстанавливается из набора двумерных изображений, зарегистрированных от объекта под разными углами. 

Из публикации, ссылку на которую Вы дали, за что большое Вам спасибо, не очень ясно: новая X-ray machine снимает одну или несколько рентгенограмм под разными углами. Если несколько, то это уже "томография". Мы в статье говорим о том, что траектория движения источника рентгена-регистратора для снятия рентгенограмм от объекта с разных сторон может быть произвольной.

Здравствуйте. Выводы прекрасны. И маленькое «но». Количество вокселей изменится в двух случаях:

  1. Если в конусно-круговой геометрии при повторном измерении вы установите ось вращения дальше от детектора или ближе к нему по сравнению с первоначальным положением.

  2. Если геометрия измерения осталась прежней, но часть объекта куда-то делась (откололась, растворилась, биорезорбировалась и т.л.).

Приветствуем! Спасибо за ваш комментарий!

Ваш опыт сопоставления слов распознанного текста с текстом из pdf очень интересен! Было бы интересным почитать или провести эксперименты, связанные с тем, что слова модель тоже могут содержать ошибки.

У нас цена удаления/вставки равна 1, поскольку удаление/вставка символа в распознанном слове чаще проявляется из-за ошибок распознавания нескольких подряд  идущих символов. То есть не было необходимости особым образом реагировать на такие ошибки.

В статье не рассмотрены ошибки поиска слов: когда слово при распознавании разбито на части (лишние пробелы) или когда объединились несколько слов (потеря пробела). Кстати, такие случаи возможны не только из-за распознавания, иногда в деловых документах между словом статического текста и словом заполнения в самом деле отсутствует пробел.

Добрый день! Благодарим!

Было бы интересно узнать, какую задачу анализа текстов Вы решали? Предложения уже были выделены или извлекались динамически?

В некоторых задачах мы ищем n-граммы (n – от 2-х до 5-ти) в строке с удаленными пробелами. Наш опыт показывает, что без штрафов f(G(V), W) здесь не обойтись.

Службы безопасности наших клиентов проводят проверку ПО на наличие закладок, вредоносного кода и отсутствие связи с внешним миром. Более того, мы сами заказываем аудит наших программ для выявления возможных рисков.

Добрый день! Благодарим за вопросы.

Лесничие будут осуществлять уход за деревьями в течение пяти лет, после чего молодой лес будет жить уже по своим законам.  
Приживаемость проекта в первый год должна составить 80%, а убыль каждый последующий год – не более 3%. В том случае, если приживаемость окажется ниже, лесничие будут подсаживать новые сеянцы.

У Smart Engines есть реальное преимущество – OCR, которая распознает 15 страниц документов за 1 секунду. И мы, как вы правильно заметили, нашли способ это доказать.

Это не эмоции, а просто факт, который нужно принять: такого результата достигла наша российская технология OCR.

А нам кажется, что вы все прекрасно понимаете. Благодарим вас за то, что повышаете рейтинг этой статьи. Но, обратите внимание, как далеко мы отошли от основной темы нашей статьи - способности отечественной OCR распознавать 15 страниц документов за 1 секунду!

Наше ПО распространяется как B2B-продукты. Впрочем, как и решения наших конкурентов.

Мы, конечно, следим за нашими конкурентами и их успехами в открытом информационном поле. Но так же, как и мы, они не дают конкурентам свои OCR решения для серьезного тестирования.

А такие сравнения имеют смысл и пользу, когда они совершены по доброй воле :)

Ответ на этот вопрос следует из того, что мы написали выше. Мы не имеем доступа к "собственническому ПО" других компаний, поэтому мы и не можем проводить таких сравнений.

В этой статье мы ссылались на наши сравнения, опубликованные еще в 2020 году (само исследование проводилось в 2019 году). На тот момент замеры были сделаны на актуальных в то время версиях OCR Tesseract. Если мы будем проводить новые сравнения, то будем использовать актуальные сейчас версии.

Конечно, OCR Tesseract – хороший продукт. Его используют в России провайдеры сервисов распознавания документов, которые не имеют собственных технологий OCR.

Если из версии 5 можно выжать 4 страницы – это хорошо, но мы же демонстрируем, как наша OCR распознает 15 страниц в секунду (это почти в 4 раза быстрее).

Приветствуем!

Да, наше ПО распознает линейные штрих-коды CODABAR, CODE_39, CODE_93, CODE_128, EAN_8, EAN_13, ITF, ITF14, UPC_A, UPC_E и матричные штрих-коды QR-код, AZTEC, PDF417 и DataMatrix.

Добрый день! Благодарим за вопрос.

Сравнение проприетарных решений могут осуществлять только заказчики или аналитические агентства, которые приобрели эти программы и имеют к ним официальный доступ.

Спасибо, поправили опечатку.

Информация

В рейтинге
Не участвует
Работает в
Зарегистрирован
Активность