Представим обычную ситуацию: экспедитор принимает товар на складе, подписывает накладную и фотографирует документ корпоративным смартфоном. Через несколько секунд реквизиты должны оказаться в учетной системе — без ручного ввода данных, офисного сканера и ожидания, пока бумага доедет до бухгалтерии.

Но есть условие: фотография не должна отправляться ни OCR‑провайдеру, ни стороннему центру обработки, ни оператору ручной верификации. В идеальном сценарии изображение вообще не покидает мобильное устройство — в корпоративную систему поступают уже извлеченные и проверенные данные.

Возможно ли распознать на смартфоне многостраничный УПД со сложной таблицей, исправить перспективу, прочитать мелкий шрифт и рукописные пометки — и сделать все это без подключения к внешней инфраструктуре? Короткий ответ: да. Однако для безопасной системы распознавания первички недостаточно написать в презентации «работает локально». Нужно правильно выстроить весь маршрут документа — от камеры смартфона до 1С или ERP.

Дисклеймер: правовая часть приведена по состоянию на август 2026 года и носит информационный характер. Режим работы с конфиденциальными сведениями необходимо проектировать с учетом документов и процессов конкретной организации.

Первичка стала мобильной, ручной ввод — пока нет

Бумажный документ появляется не там, где стоит компьютер бухгалтера. Накладные подписывают на складе, акты — на объекте, транспортные документы — при передаче груза, счета получают во время встречи с контрагентом. Если точкой ввода остается офисный сканер, между хозяйственной операцией и ее отражением в учете возникает задержка.

При большом объеме документов эта задержка превращается в рабочие часы. Бухгалтеру необходимо принять документ, определить его тип, перенести реквизиты и номенклатуру, проверить суммы и НДС, исправить опечатки, а затем вернуть спорные позиции ответственному подразделению. Сложная накладная с сотнями строк может занять от десятков минут до нескольких часов.

Цена этих часов растет вместе с кадровой нагрузкой. В ноябре 2025 года только в Москве работодатели искали более 7 тыс. бухгалтеров, а российские кадровые агентства отмечают примерно 12-процентное увеличение вакансий бухгалтеров и аудиторов. В отдельных регионах спрос на административно‑управленческий персонал, включая бухгалтеров, в начале 2025 года вырос в разы.

И автоматизация здесь нужна не для того, чтобы заменить бухгалтера нейросетью. Ее более практичная задача — перестать «расходовать» квалифицированного специалиста на роль оператора ввода.

Что именно мы защищаем в бухгалтерском документе

В счете‑фактуре нет пароля от производственной линии, а в ТОРГ-12 — исходного кода. Поэтому риск передачи таких документов наружу легко недооценить. Однако серия УПД, счетов, актов и накладных дает довольно подробную модель бизнеса:

  • номенклатуру, объемы и периодичность закупок;

  • цены, скидки, ставки НДС и структуру себестоимости;

  • поставщиков, покупателей и логистические цепочки;

  • фактические сроки поставок и расчетов;

  • сведения о строящихся объектах, подрядчиках и выполненных работах;

  • банковские реквизиты и образцы подписей ответственных лиц.

Массив документов позволяет восстановить структуру расходов, условия работы с контрагентами и динамику хозяйственной деятельности. 

Передача документов стороннему сервису увеличивает число точек, которые необходимо контролировать: сетевые соединения, серверную инфраструктуру, журналы событий, резервные копии и доступ сотрудников подрядчика. Даже при соблюдении всех формальных требований остается риск утечки, несанкционированного доступа или хранения данных дольше, чем предусмотрено процессом. Поэтому самый надежный способ защитить «хранилище» с фотографиями первички — не создавать его за пределами устройства.

Что диктует законодательство

Согласно 98-ФЗ «О коммерческой тайне», организация самостоятельно определяет перечень сведений, которые относятся к коммерческой тайне, и устанавливает режим их защиты. Для этого необходимо в том числе ограничить доступ к информации, определить порядок обращения с ней и вести учет лиц, получивших доступ.

Для бухгалтерских документов безопасность должна обеспечиваться уже при получении изображения: фотография накладной, акта или УПД распознается на мобильном устройстве и не передается внешним сервисам. Это сокращает число участников процесса и сохраняет данные внутри контролируемого контура организации.

Дополнительный ориентир дает 149-ФЗ «Об информации, информационных технологиях и о защите информации». Защита информации должна предотвращать неправомерный доступ, обеспечивать своевременное обнаружение инцидентов и позволять восстанавливать данные. Чем меньше независимых участников участвует в обработке, тем проще контролировать выполнение этих требований. Когда распознавание изображения происходит непосредственно на мобильном устройстве, снижается поверхность атаки: исходный документ не проходит через внешнюю инфраструктуру, облачные сервисы и системы ручной верификации.

Есть и еще одна граница, которую полезно провести заранее. ФНС разъяснила, что с 1 января основным формализованным электронным документом для подтверждения отгрузки, выполнения работ и оказания услуг стал УПД формата 5.03. При этом бумажные и неформализованные электронные документы не исчезли. Значит, некоторое время бизнесу придется обрабатывать смешанный поток: формализованный ЭДО, PDF, фотографии и бумажные оригиналы. У такой первички могут отличаться не только формат и качество изображения, но и структура, набор реквизитов и логика заполнения. Поэтому мобильному решению важно не просто извлекать текст из фотографии, а самостоятельно определять тип документа и выбирать подходящий сценарий распознавания — для УПД, счета, накладной, акта или другой формы. Иначе сотруднику придется вручную классифицировать документы, переключать режимы и проверять, корректно ли система выбрала шаблон.

Почему безопасность определяется маршрутом документа

Внешнее распознавание начинается с передачи изображения за пределы устройства. Далее документ проходит через сеть, API, очереди и инфраструктуру исполнителя. В отдельных схемах к результату может подключаться оператор ручной проверки.

В on‑device‑сценарии маршрут принципиально короче:

  • камера передает кадр OCR‑модулю внутри приложения;

  • изображение обрабатывается в оперативной памяти устройства;

  • классификация, распознавание и оценка качества выполняются локально;

  • приложение получает структурированные поля и оценки уверенности;

  • в 1С, ERP или СЭД передаются необходимые учетные данные;

  • исходный кадр удаляется, если его хранение не предусмотрено процессом.

Из цепочки исключаются передача исходного изображения внешнему обработчику, промежуточное хранение и человеческая верификация за пределами компании.

Что смартфон успевает сделать за несколько секунд

На вход OCR получает не аккуратный скан, а фотографию: документ может лежать под углом, изгибаться, попадать в тень или частично бликовать. Строки таблицы уходят в перспективу, мелкий текст теряет контраст, а печать накладывается на реквизиты. Поэтому мобильное распознавание первички требует не просто найти текст на изображении, а последовательно решить целый комплекс задач

В Smart Document Engine обработка проходит в несколько этапов. Система находит документ в кадре, определяет его границы, исправляет геометрические искажения и оценивает качество изображения. Затем классифицирует форму и извлекает бизнес‑значимые поля: номер и дату, реквизиты сторон, суммы, ставки НДС, номенклатуру, количество и стоимость позиций. Отдельно обрабатываются таблицы, рукописные пометки, чекбоксы, штрихкоды, подписи, печати и штампы электронной подписи. Для каждого распознанного элемента можно получить координаты, альтернативы и оценку уверенности. Это позволяет не проводить все документы через одинаковую ручную проверку, а направлять сотруднику только поля, которые не прошли заданный порог или нарушили бизнес‑правило.

Smart Document Engine поддерживает УПД и УКД, счета и счета‑фактуры, ТОРГ-12, транспортные накладные, акты, КС-2 и КС-3, банковские и платежные документы, акты сверки и многостраничные формы. Алгоритмы не требуют жесткой привязки к единственному макету документа.

Страница А4 распознается на смартфоне примерно за 2–3 секунды, вычисления выполняются на CPU без использования GPU и NPU. Вот как это работает.

Вместо заключения: миф или реальность?

Полностью локальное распознавание бухгалтерской первички на смартфоне — уже не эксперимент и не упрощенный OCR для пары реквизитов. Современное мобильное устройство способно исправить геометрию фотографии, классифицировать документ, прочитать сложную таблицу, извлечь печатные и рукописные поля и вернуть структурированный результат за несколько секунд.

Для бизнеса главное преимущество такой архитектуры даже не в отказе от сканера. Документ можно распознать в той точке, где он появился, и сразу передать данные в учетный процесс, не создавая промежуточную очередь из бумаги, фотографий и ручного ввода.

Для информационной безопасности преимущество еще фундаментальнее: исходное изображение не нужно передавать разработчику OCR, внешнему центру обработки или оператору верификации. Чем меньше участников видят документ и чем короче его маршрут, тем меньше потенциальных точек утечки.