Ну что же, уважаемые подписчики! С днем меня и в этот день хотел с Вами поделиться новенькое разработкой, о которой писал ранее🦩
🔥Представляю Вашему вниманию Beresta.AI — локальный ИИ-помощник для систематизации отсканированных документов.
Пока что получилось собрать только пэт-проект на гитхаб (надеюсь он у Вас запустится, потому что собирал я его на маке, на Винде не пробовал😅).
1. Что делает программа?
• Разделять свиток — разделить PDF с десятками документов и получить каждый акт или договор отдельным файлом (с возможностью редактирования называемых файлов и предварительного просмотра при 2-м нажатии на строку наименования)
• Нарекать грамоты — переименовывать PDF в осмысленные названия по типу, сторонам и датам
• Прочесть письмена — конвертировать сканы и фото в Word, Markdown или TXT с помощью OCR
2. Как работает?
OCR-движки (Docling от IBM, PaddleOCR и Apple Vision (если у Вас Mac ) и локальная ИИ-модель Qwen 3.5 9b
3. Что по железу?
Программа требует хорошую пекарню, потому что нормально извлекать данные из отсканированных документов получилось через ЛЛМ на 9 миллиардов параметров. У меня мак мини на м4 16 гб оперативки и документ в 66 листов обрабатывался 70 минут.
Возможно у Вас получится добавить модель поменьше и она также хорошо будет выдавать результаты, то отпишитесь пожалуйста🙏
🪙4. Конфиденциальность.
Программа работает строго на Вашем компьютере. Для первого запуска понадобится скачать необходимые библиотеки, нейросеть и на этом усё.
5. От «нас», что сейчас требуется?
Порадоваться за меня😁, протестировать и написать пожелания по улучшению (есть такая кнопка там).
⚠️Проект очень сырой, поэтому возможно даже в среде разработки что-то пойдёт не так и у Вас не заработает😀
В ближайшее время надеюсь собрать привычные десктоп приложения для мака и винды.
А еще мой канал набрал 400 человек (во второй раз), поэтому тоже искренне рад, что Вы следите за новостями!✊ (не отписывайтесь пж после данного поста, иначе 😄).
Post #57
697