← Назад к новостям

Как мы написали свой OCR и автоматизировали горы первички


Когда внутренних заказчиков становится слишком много — каждый со своими хотелками и типом документов — поддерживать кучу отдельных сервисов уже нереально.

Отдел кадров приносит документы о приёме на работу, бухгалтерия хочет сверять финансовую отчётность, другие подразделения — своё. Нужен был единый сервис, который умеет распознавать документы и гибко настраивать извлечение данных под любой шаблон.

Ситуацию усложнил уход западных вендоров — тот же ABBYY стал недоступен. Просто взять и купить готовый зарубежный софт мы не могли — ни по соображениям безопасности, ни по факту: рынок сам закрыл эту возможность.

Нужно было решение, которое работает строго внутри защищённого контура. С открытым API, через который можно интегрироваться с практически любой внутренней системой.

Так в Гринатоме (ИТ-интеграторе Росатома) мы начали разработку Атом.Око. Это система, которая не просто видит текст на скане, а понимает структуру документа. Вытаскивает реквизиты, проверяет наличие подписей и печатей.

Читать далее
📊 Источник: Habr | Оригинал