Пока что DOCXдодыр еще дорабатываю, поскольку с каждой новой сущностью приходится делать отладку, и чем дальше, тем больше тестов требуется. Надеюсь, все же довести до конца и выложить на GitHub.
Но у меня сейчас в разработке другой концепт приложения для разделения отсканированных документов и их переименования или просто переименования. Назвал я его «Береста.ИИ». Нравится мне вот русский культурный код использовать при нейминге приложений 😅
Знаю, что Claude Code может делать то же самое, но мое «изобретение» бесплатное))
Под капотом тут Tesseract и локальная LLM от Google (Gemma 2). Пока делаю тесты. Документ разбивает как надо, а вот с переименованием сложнее обстоят дела: локальное ИИ тупит, но я взял маленькую модель всего на 1,5 ГБ. В общем, как доделаю, тоже выложу на GitHub, в том числе. А пока приложу концепт)
Post #56
656

- ❤ 12
- 🔥 7