После публикации в открытом доступе CuneiForm и Tesseract OCR вопрос полнотекстового офлайн распознавания для бытовых нужд фактически стал закрытым. Эти движки встроены в десятки прикладных инструментов для ПК, позволяющих решить возникающие мелкие бытовые задачи, сведя на "нет" необходимость в коммерческом софте.
Другой вопрос - промышленное распознавание документов, где и постановка задачи отличается, и требования к ПО совершенно другие, и программные решения полноценно отечественные (читай - наши).
Да, действительно, подобные вопросы часто возникают в задачах подсчета статистик в скользящем окне. И, как вы верно отметили, абсолютные центральные моменты почти никогда не нужны, видимо поэтому мы не смогли найти где-то описанного ранее алгоритма :)
В случае обработки в скользящем окне упомянутый вами двухпроходный алгоритм, скорее всего, действительно более практичен: он будет и более стабилен вычислительно, да и трудоемкость отходит по важности на второе место (т.к. зависит она от размера окна а не от размера постоянно растущей выборки). В нашем же случае мы скорее ориентировались на случай с растущими выборками и нас больше всего интересовала трудоемкость обновления (больше, чем вычислительная стабильность).
Кстати, по поводу вычислительной стабильности, работа 2016-го года, на которую мы ссылаемся в тексте (https://link.springer.com/article/10.1007/s00180-015-0637-z) о быстром обновлении центральных моментов (не абсолютных) почти целиком посвящена проблемам накопления ошибки вычислений с плавающей точкой. Этот вопрос там хорошо и подробно рассмотрен, рекомендуем.
Разумеется, существует множество как платного, так и бесплатного ПО для 3D визуализации.
Для реконструкции и визуализации 3D изображений мы пользуемся собственным софтом STE, но он, конечно, платный (вот статья про него). Немного результатов наших визуализаций можно найти тут, тут и тут.
Из бесплатных можем порекомендовать: ImageJ (Используется учёными для численного анализа изображений).
Оценка точности результатов при использовании нейросетевых моделей - это важная задача, над решением которой мы в SE работаем, говоря об Ответственном искусственном интеллекте.
У нас больше 150 статей на Хабре, где мы делимся не только историями удачного применения технологий распознавания документов, но и рассказываем про особенности наших продуктов, про уникальные алгоритмы, которые используются под капотом, про производительные аспекты решений на разных вычислительных платформах (включая отечественные Эльбрусы).
Мы постоянно развиваем наше ПО и регулярно предоставляем клиентам новые версии. Только так можно успешно работать в условиях вечного соревнования между мошенниками и защитниками.
В нелегальном мире поддельных документов встречаются разные категории. Один из самых распространённых способов подделки документа - переклейка фотографии, которая автоматически выявляется при мультиспектральном сканировании и анализе.
Правила выдачи документов регламентируется законодательно. Например, порядок выдачи паспорта гражданина Российской Федерации четко прописан в Постановлении Правительства РФ от 08.07.1997 N 828. Документы, выданные с нарушениями, считаются недействительными.
В этой статье мы рассказали исключительно базу моделирования томографических проекций. Про рассеяние, ужесточение пучка и многие другие эффекты нам известно не понаслышке - мы не только успешно их моделируем, но и прекрасно редуцируем артефакты, связанные с ними. К примеру, советуем ознакомиться с нашей статьейпро подавление артефактов, вызванных beam hаrdening. Эту и многие другие наработки мы уже внедрили в наш продукт Smart Tomo Engine
Рустам, Вы немного торопите события :) В текущей статье мы постарались ознакомить читателя с основными объектами и целями моделирования в рентгеновской компьютерной томографии. После получения патентов и печати научных публикаций по нашим продвинутым моделям, мы сможем поделиться ими с уже подготовленным читателем.
Мы это и имели в виду, когда говорили про 1.8 Мб. То есть наш WebSDK вместе со всей конфигурацией для распознавания карт, в сжатом gzip виде занимает всего 1.8.
Про порядок загрузки, вопросы кэширования и т.п. мы постарались подробнее рассказать вот здесь.
По остальным вопросам, включая запросы на тестирование и прайс - связывайтесь с нашим отделом продаж здесь.
Именно это у нас и вызывает возмущение. Доколе будет так? С технологией стерео все наоборот! Вычислений нет, а трехмерная картинка доставляется в мозг.
Развитие PWA – стратегически верный шаг вперед. Популяризация PWA в дальнейшем позволит отказаться от проприетарного ПО Apple, Google. Разработчики могут не обращать внимания на потенциальные изменения, которые могут инициировать эти компании.
А всякая "механика" типа стикеров - это, скорее, временное решение, позволяющая нашим финансовым институтам хоть как-то решить внезапно возникшую проблему.
Да-да, мы тоже категорически против того, чтобы WASM использовался для всяких примитивных задач типа "фоточку обработать"!
То ли дело наше решение, которое позволяет получить весь функционал (включая разные приятные фишечки ИИ вроде распознавания QR-кодов и считывания номеров банковских карт), ранее доступный только в нативном мобильном приложении, теперь прямо в браузере.
Но Даша еще не решила выбрать электронику в качестве будущего поля деятельности. И мы надеемся, что если решит, то непременно оттомографирует и объекты из вашего списка.
Паспорт просят не просто так, а для целей удостоверения личности. И здесь скорее прав комментатор выше, который призывает прекратить проверять личность без необходимого на то повода.
После публикации в открытом доступе CuneiForm и Tesseract OCR вопрос полнотекстового офлайн распознавания для бытовых нужд фактически стал закрытым. Эти движки встроены в десятки прикладных инструментов для ПК, позволяющих решить возникающие мелкие бытовые задачи, сведя на "нет" необходимость в коммерческом софте.
Другой вопрос - промышленное распознавание документов, где и постановка задачи отличается, и требования к ПО совершенно другие, и программные решения полноценно отечественные (читай - наши).
Добрый день, благодарим за интерес к публикации!
У нас используется наша собственная OCR, которая поддерживает 103 языка и работает в том числе на мобильных телефонах.
Спасибо за ваш интерес!
Да, действительно, подобные вопросы часто возникают в задачах подсчета статистик в скользящем окне. И, как вы верно отметили, абсолютные центральные моменты почти никогда не нужны, видимо поэтому мы не смогли найти где-то описанного ранее алгоритма :)
В случае обработки в скользящем окне упомянутый вами двухпроходный алгоритм, скорее всего, действительно более практичен: он будет и более стабилен вычислительно, да и трудоемкость отходит по важности на второе место (т.к. зависит она от размера окна а не от размера постоянно растущей выборки). В нашем же случае мы скорее ориентировались на случай с растущими выборками и нас больше всего интересовала трудоемкость обновления (больше, чем вычислительная стабильность).
Кстати, по поводу вычислительной стабильности, работа 2016-го года, на которую мы ссылаемся в тексте (https://link.springer.com/article/10.1007/s00180-015-0637-z) о быстром обновлении центральных моментов (не абсолютных) почти целиком посвящена проблемам накопления ошибки вычислений с плавающей точкой. Этот вопрос там хорошо и подробно рассмотрен, рекомендуем.
Приветствуем!
Разумеется, существует множество как платного, так и бесплатного ПО для 3D визуализации.
Для реконструкции и визуализации 3D изображений мы пользуемся собственным софтом STE, но он, конечно, платный (вот статья про него). Немного результатов наших визуализаций можно найти тут, тут и тут.
Из бесплатных можем порекомендовать: ImageJ (Используется учёными для численного анализа изображений).
Оценка точности результатов при использовании нейросетевых моделей - это важная задача, над решением которой мы в SE работаем, говоря об Ответственном искусственном интеллекте.
Спасибо за комментарий. Наша позиция - не равняться на конкурентов, а просто делать хорошо. Кстати, про ABBYY: здоровья ушедшим...
Добрый день!
У нас больше 150 статей на Хабре, где мы делимся не только историями удачного применения технологий распознавания документов, но и рассказываем про особенности наших продуктов, про уникальные алгоритмы, которые используются под капотом, про производительные аспекты решений на разных вычислительных платформах (включая отечественные Эльбрусы).
Приглашаем Вас читать наш Хабр!
Наш софт защищает как от мамкиных переклейщиков, так и от пациентов посерьезнее)
Мы постоянно развиваем наше ПО и регулярно предоставляем клиентам новые версии. Только так можно успешно работать в условиях вечного соревнования между мошенниками и защитниками.
В нелегальном мире поддельных документов встречаются разные категории. Один из самых распространённых способов подделки документа - переклейка фотографии, которая автоматически выявляется при мультиспектральном сканировании и анализе.
Правила выдачи документов регламентируется законодательно. Например, порядок выдачи паспорта гражданина Российской Федерации четко прописан в Постановлении Правительства РФ от 08.07.1997 N 828. Документы, выданные с нарушениями, считаются недействительными.
В этой статье мы рассказали исключительно базу моделирования томографических проекций. Про рассеяние, ужесточение пучка и многие другие эффекты нам известно не понаслышке - мы не только успешно их моделируем, но и прекрасно редуцируем артефакты, связанные с ними. К примеру, советуем ознакомиться с нашей статьей про подавление артефактов, вызванных beam hаrdening. Эту и многие другие наработки мы уже внедрили в наш продукт Smart Tomo Engine
Рустам, Вы немного торопите события :) В текущей статье мы постарались ознакомить читателя с основными объектами и целями моделирования в рентгеновской компьютерной томографии. После получения патентов и печати научных публикаций по нашим продвинутым моделям, мы сможем поделиться ими с уже подготовленным читателем.
Мы это и имели в виду, когда говорили про 1.8 Мб. То есть наш WebSDK вместе со всей конфигурацией для распознавания карт, в сжатом gzip виде занимает всего 1.8.
Про порядок загрузки, вопросы кэширования и т.п. мы постарались подробнее рассказать вот здесь.
По остальным вопросам, включая запросы на тестирование и прайс - связывайтесь с нашим отделом продаж здесь.
Именно это у нас и вызывает возмущение. Доколе будет так? С технологией стерео все наоборот! Вычислений нет, а трехмерная картинка доставляется в мозг.
Модуль с картами занимает 1.8 Мб.
Развитие PWA – стратегически верный шаг вперед. Популяризация PWA в дальнейшем позволит отказаться от проприетарного ПО Apple, Google. Разработчики могут не обращать внимания на потенциальные изменения, которые могут инициировать эти компании.
А всякая "механика" типа стикеров - это, скорее, временное решение, позволяющая нашим финансовым институтам хоть как-то решить внезапно возникшую проблему.
Да-да, мы тоже категорически против того, чтобы WASM использовался для всяких примитивных задач типа "фоточку обработать"!
То ли дело наше решение, которое позволяет получить весь функционал (включая разные приятные фишечки ИИ вроде распознавания QR-кодов и считывания номеров банковских карт), ранее доступный только в нативном мобильном приложении, теперь прямо в браузере.
Но Даша еще не решила выбрать электронику в качестве будущего поля деятельности. И мы надеемся, что если решит, то непременно оттомографирует и объекты из вашего списка.
Паспорт просят не просто так, а для целей удостоверения личности. И здесь скорее прав комментатор выше, который призывает прекратить проверять личность без необходимого на то повода.