Этот пост о том, что Datana работает не только в технологическом и производственных сегментах (L2-L3), но и в корпоративном (L4). Да, мы не закисли, все время развиваемся.
Для Заказчика-металлурга делаем агента по распознанию входящих и исходящих документов. Это должно работать на лету и здорово облегчать труд бухгалтерской службы. Поэтому между собой мы называем проект БухИИ (ласково).
На видео фрагмент (с цензурой) проведенного демо, показываем фрагмент проекта. Сейчас он разросся, это уже 6 документов, одиночных и пакетных.
Мы должны понимать тип документа, выбирать нужные атрибуты из него и передавать в третьи системы. То есть, UI сделан лишь для демо.
Штука в том, что документы могут отличаться по шаблону и содержат рукописный текст. От нас требуется качество. Проделана огромная аналитическая работа. Разработано ядро (модели классификации, тюнинг OCR на GPU), и оно отлично себя показывает. Аналогов нет, конечно же (sic!) Никакой отечественный бигтех, опенсорц и даже платные библиотеки задачу не решают с достаточной точностью. И да, решение легкое, без огромных LLM.
Проект пока не закончен, но уже на финальной стадии.
Мы есть в MAX!
Post #385
608
- 👍 15