ТАСС пишут про проект от коллег из Industrial AI Lab Института ИИ ИТМО - библиотеку DocuMentor.
DocuMentor позволяет с высокой точностью (до 98%) извлекать иерархическую структуру PDF-файлов: заголовки, таблицы, формулы, изображения. Библиотека работает на основе локальной VLM, поддерживает PDF, DOCX и Markdown, а ошибок при распознавании слов даёт в 6–10 раз меньше аналогов. Реализация - на Python.
В репозитории есть пример сравнения с конкурирующими решениями - Marker и Dedoc (разработка ИСП РАН).
Звёзды и отзывы приветствуются: https://github.com/aimclub/documentor
Post #207
1.71K

- 🔥 22