Несколько лет назад российский рынок программного обеспечения пережил серьезную перестройку: из страны ушли многие международные вендоры, а бизнесу пришлось в короткие сроки искать замену привычным решениям. Особенно заметно это отразилось на рынке технологий распознавания документов, где долгое время значительную долю занимали продукты ABBYY.
С тех пор многое изменилось. Российские разработчики существенно продвинулись вперед, а на рынке появились зрелые отечественные технологии, способные полностью заменить зарубежные решения. Разберемся, чем сегодня можно импортозаместить ABBYY, какие требования стоит предъявлять к российской системе распознавания и на что обратить внимание при выборе.
Почему компании ищут альтернативу ABBYY
До 2022 года ABBYY была лидером в сфере технологий оптического распознавания в России. Компания прославилась своими продуктами Abbyy FineReader, Abbyy Lingvo и представляла также решения для бизнеса ABBYY FlexiCapture – системой, которая использовалась для оцифровки бумажных документов и интеллектуальной обработки информации. Решение автоматически извлекало данные из документов и для ввода их в корпоративные информационные системы. Крупным корпорациям это давало возможность гибко и удобно управлять всей информацией в едином потоке.
В 2022 году ABBYY объявила о прекращении продаж продуктов и услуг на территории России. Компания также удалила из реестра отечественного ПО Минцифры РФ два десятка своих продуктов, которые повсеместно использовались госкорпорациями и крупным бизнесом. В том числе из реестра был исключен продукт Abbyy FlexiCapture.
Как началось импортозамещение ABBYY в России
Когда ABBYY свернула свою деятельность в России, отечественные компании столкнулись с серьезной проблемой: системы распознавания ABBYY было практически нечем заменить. Отечественные продукты сильно уступали FlexiCapture как по точности распознавания, так и по удобству использования, надежности и другим параметрам. Перед российской ИТ-отраслью была поставлена амбициозная, но крайне сложная задача – импортозаместить программное обеспечение для бизнеса, предназначенное для оптического распознавания документов.
Российский аналог должен был покрывать основной функционал FlexiCapture. А именно, уметь автоматически определять тип документа; распознавать печатные и рукопечатные (написанные рукой отдельными буквами) реквизиты; находить чек-боксы; извлекать данные таблиц из документов; проверять подписи и печати. При этом важно, чтобы продукт интегрировался с различными информационными системами.
Однако и это еще не все. Импортозаместить не значит просто создать похожую программу. Процесс замены иностранного программного обеспечения отечественным предполагает целый комплекс мер, к которому предъявляется множество законодательных требований. Поскольку речь идет о технологиях, которые используются в том числе стратегически значимыми предприятиями, ключевую роль играют вопросы независимости и безопасности технологий. Все это должно учитываться при разработке решения, в части отказа от использования ПО западных разработчиков.
Smart Engines как российская альтернатива ABBYY
Все это удалось учесть в своих разработках ученым из компании Smart Engines, которая сегодня уверенно занимает место одного из самых сильных игроков на рынке оптического распознавания в РФ. Специалисты компании Smart Engines, которая уже 10 лет является лидером по технологиям распознавания паспорта и других удостоверяющих документов РФ и всех стран мира известна разработали ПО для ввода данных из первичных бухгалтерских, кадровых и других бизнес-документов для автоматизации документооборота. Это решение базируется на передовых сверхлегких нейросетях и не только не уступает зарубежным аналогам, но и превосходит их — в частности, в вопросе скорости и качества распознавания, поддержке распознавания прямо на мобильных устройствах и возможности распознавания рукописного текста.
Компания предлагает сразу несколько продуктов, которые направлены на закрытие потребностей бизнеса и государства в системах распознавания документов. К ключевым пакетным решениям для распознавания широкого класса документов для бизнеса относятся Smart Document Engine и Smart Text Engine.
Smart Text Engine — это уникальная OCR-система на базе искусственного интеллекта, предназначенная для автоматизации документооборота. Она распознает любые текстовые документы на более чем 100 языках мира, от служебных записок до договоров, и извлекает из них текстовую информацию. Решение поддерживает все виды текстовых документов вне зависимости от шрифта и распознает не только печатный, но и рукописный текст, в том числе надписи и пометки. Причем справляется с этим практически мгновенно: скорость распознавания в серверных решениях достигает 1800 страниц в минуту или 30 страниц в секунду.
Smart Engines также предлагает продукт для распознавания и извлечения реквизитов из структурированных документов – Smart Document Engine. Эта библиотека подпрограмм (SDK) подходит для работы с бланками и формами, от счетов на оплату до актов, накладных и передаточных документов, и выделения реквизитов из деловых документов. Как и Smart Text Engine, решение распознает любые текстовые данные, однако здесь на выходе пользователь получает уже не просто строки оцифрованного текста, а полноценные реквизиты. Продукт особенно полезен для бизнеса, перед которым стоит задача систематизации данных из больших потоков бухгалтерских и учетных документов – актов, УПД, счетов-фактур, форм ТОРГ-12, накладных, выписок из ЕГРЮЛ, налоговых деклараций, финансовых отчетов, приказов, уставов и прочих форм. Актуальная версия Smart Document Engine поддерживает более 70 преднастроенных шаблонов документов и позволяет самостоятельно настраивать шаблоны распознавания в дизайнере форм.
Для распознавания удостоверяющих документов у Smart Engines есть Smart ID Engine 2.0 – библиотека подпрограмм (SDK) для высокоточного и безопасного распознавания данных паспорта РФ и еще более 3000 типов удостоверяющих документов более чем 200 юрисдикций мира на фотографиях, сканах и в видеопотоке. Система автоматически распознает все страницы и данные паспорта РФ и других документов, находит все штампы и может обрабатывать видео, сканы и фотографии документов на мобильных устройствах, стационарных компьютерах, серверах и даже в веб-браузерах.
Smart Engines и ABBYY: сравнение технологий и возможностей
Для компаний, которые рассматривают переход с ABBYY на российские решения для интеллектуальной обработки документов, важно сравнить продукты не только по набору функций, но и по технологическим особенностям. Ниже собраны основные критерии, которые стоит учитывать при выборе системы распознавания и автоматической обработки документов.
| Критерий | ABBYY | Smart Engines |
| Разработчик технологий | ⚠️ Зарубежный вендор | ✅ Российская компания |
| Наличие в Реестре российского ПО | ❌ Нет | ✅ Да |
| Соответствие задачам импортозамещения | ❌ Не подходит для импортозамещения | ✅ Полностью соответствует требованиям импортозамещения |
| OCR и распознавание печатного текста | ✅ Высокое качество распознавания текстов и PDF | ✅ Качество OCR до 99,9% с фокусом на ключевые корпоративные сценарии |
| Распознавание на мобильных устройствах | ❌ Недоступно. Распознавание выполняется на сервере | ✅ Высокоточное распознавание на мобильных устройствах. Паспорт на смартфоне распознается за 0,15 секунды |
| Распознавание в браузере и мессенджерах | ⚠️ Только через облачную обработку с передачей данных на внешний сервер | ✅ Возможно. Полностью локальное распознавание в браузере и мессенджерах без передачи данных за пределы устройства |
| Распознавание в Telegram | ❌ Нет | ✅ Есть |
| Распознавание в МАХ | ❌ Нет | ✅ Есть |
| Распознавание рукописного кириллического шрифта | ⚠️ Не заявлено | ✅ Высокоточное распознавание рукописного текста, надписей и пометок |
| Интеллектуальная обработка документов | ✅ Есть возможности IDP | ✅ Развитые возможности IDP с акцентом на российские бизнес-процессы |
| Распознавание паспорта и удостоверений личности | ⚠️ Поддерживается только специализированными компонентами | ✅ Одно из ключевых направлений Smart ID Engine. Поддержка рукописного заполнения основного разворота и страницы прописка. Поддержка ДУЛ 230 стран и юрисдикций |
| Распознавание бухгалтерских документов | ✅ Поддерживается | ✅ Специализация на первичных бухгалтерских, финансовых и юридических документах. В общей сложности более 40 типов без учета ДУЛ. |
| Локальное развертывание внутри защищенного контура | ✅ Возможна | ✅ Да. Является одним из базовых принципов архитектуры |
| Передача данных во внешние сервисы | ⚠️ Зависит от конфигурации | ✅ Не требуется |
| Гибкость интеграции | ⚠️ Ограниченная, не подходит для российских ОС | ✅ Высокая, есть сертификаты совместимости с российскими ОС и архитектурами |
| Применение в банковском секторе | ❌ Нарушает принцип ИТ-суверенитета | ✅ Активно применяется для KYC, цифрового онбординга и построения кредитного конвейера |
| Применение в государственном секторе, промышленности и на объектах КИИ | ❌ Запрещено | ✅ Полностью соответствует требованиям регулируемых отраслей |
| Наличие официальной поддержки от разработчика | ❌ Нет | ✅ Есть. Регулярные |
По ключевым для российского бизнеса критериям Smart Engines сегодня полностью закрывает те задачи, для которых раньше использовались решения ABBYY: OCR, извлечение реквизитов, обработку удостоверяющих и бухгалтерских документов, рукописного текста и интеграцию в корпоративные системы.
При этом Smart Engines дает возможности, критичные именно для импортозамещения: входит в Реестр российского ПО, поддерживает локальное развертывание, работает на мобильных устройствах и прямо в браузере без передачи документов во внешние сервисы, совместим с российскими ОС и может использоваться в регулируемых отраслях. Поэтому переход с ABBYY на Smart Engines – это не просто формальная замена зарубежного ПО, а переход на технологически самостоятельное российское решение без отказа от ключевой функциональности.
Вместо вывода: чем заменить ABBYY в России
Сегодня импортозамещение ABBYY уже не означает переход на менее функциональный продукт. Российские OCR-решения позволяют закрыть основные задачи автоматического распознавания и интеллектуальной обработки документов – от извлечения текста и реквизитов до работы с паспортами, бухгалтерскими документами, рукописными данными и большими корпоративными потоками.
Smart Engines может рассматриваться как полноценная российская альтернатива ABBYY для бизнеса, государственных организаций и компаний из регулируемых отраслей. Решения компании поддерживают локальное развертывание, работают без обязательной передачи данных во внешние сервисы, интегрируются в российскую ИТ-инфраструктуру и входят в Реестр российского ПО. При этом технологии Smart Engines позволяют выполнять распознавание не только на серверах, но и непосредственно на мобильных устройствах и в веб-браузере.
Таким образом, при выборе российского аналога ABBYY важно оценивать не только качество OCR, но и независимость технологии, безопасность обработки данных, возможности интеграции и соответствие требованиям импортозамещения. По совокупности этих критериев Smart Engines закрывает ключевые сценарии, для которых российские компании ранее использовали продукты ABBYY.