Рукописные заявления и анкеты — архисложная задача для LLM ⚡️
В русском языке строчные «ш», «и» и «л» при быстром письме могут быть настолько похожи, что даже человеку бывает трудно понять, что именно написано.
Для генеративной модели здесь возникает дополнительный риск: вместо точного распознавания она может выбрать наиболее вероятное слово по контексту. Но при работе с документами угадывать нельзя — нужно извлечь именно те данные, которые есть на бумаге.
Поэтому качественная интеллектуальная обработка начинается не с генерации, а с точного OCR.
💼 Smart Engines разработала нейросетевую архитектуру «Да Винчи», которая распознает рукописный текст без использования словарей и других лингвистических подсказок. Система работает даже с трудноразборчивым почерком, рукописными пометками и комментариями, а также текстом, написанным ручкой, карандашом или пером.
Нейросеть не опирается на знания о словах русского языка и анализирует особенности сопряжения букв непосредственно на изображении. Наш суверенный ИИ извлекает строго то, что написано на бумаге, такой подход снижает риск «додумывания» и галлюцинаций.
Разработка уже используется для полнотекстового распознавания рукописных документов, заявлений, анкет и других форм.
Чтобы дополнительно снизить риск ошибок, «Да Винчи» обучена на 1,2 млн синтезированных строк рукописного текста с равномерным распределением сочетаний букв.
Как технологии Smart Engines распознают один из самых коварных рукописных слов, — смотрите в ролике ⬆️
Post #566
124
- 🔥 7
- ❤ 2
- 💯 1