Logics-Parsing
При обработке академических статей или исследовательских отчётов с помощью OCR, когда в документе есть сложные формулы, таблицы и графики, к качеству распознавания модели предъявляются особенно высокие требования.
Техническая команда Alibaba недавно выложила в опенсорс end-to-end модель для парсинга документов — Logics-Parsing, которая умеет напрямую конвертировать сложные документы в структурированный HTML.
Модель не только корректно распознаёт сложные научные формулы и химические структуры, но и автоматически отфильтровывает лишний контент вроде колонтитулов и футеров, фокусируясь на извлечении основной информации.
Поддерживаются разные типы входных данных: исследовательские отчёты, научные статьи, химическая документация, рукописные заметки и др.
В ряде бенчмарков модель показала результаты выше многих аналогов. Если у вас есть задачи по OCR сложных документов — стоит попробовать.
📁 Language: #Python 100.0%
⭐️ Stars: 369
➡️ Cсылка на GitHub
📱 @git_developer
Post #1082
3.55K
- ❤ 13
- 👍 9
- 🔥 1