Извлечь текст из PDF мало. LightOnOCR-3 достаёт ещё и данные из графиков 📄
LightOn выпустила семейство открытых моделей для обработки документов. За один проход они:
• распознают печатный и рукописный текст;
• сохраняют структуру страницы и координаты блоков;
• описывают изображения;
• превращают данные с графиков в таблицы.
Доступны три размера: 0,8B, 1B и 4B. Лицензия Apache 2.0 позволяет адаптировать модели и разворачивать их на своей инфраструктуре.
По тестам разработчиков, версия 4B набирает 86,3 на olmOCR-Bench, опережая Chandra 2, Mistral OCR 4.1 и dots.mocr. На ParseBench версии 4B и 0,8B занимают первые два места среди моделей в опубликованном сравнении.
Полезный инструмент для подготовки отчётов, сканов и технической документации к поиску, аналитике и RAG.
https://huggingface.co/blog/lightonai/lightonocr-3
Post #3074
1.88K
- 🔥 11
- 👏 5
- ❤ 3
- 🤔 1