Забираем самую полезную тулзу для подготовки отчётов и технических доков к поиску, аналитике и RAG — LightOnOCR-3! Это семейство открытых моделей для обработки документов: берём данные не только из PDF, но и из графов.
Модели:
🔅 Распознают печатный и рукописный текст;
🔅 Сохраняют структуру страницы и координаты блоков;
🔅 Описывают пикчи;
🔅 Превращают данные с графиков в таблицы.
Всего есть три размера: 0,8B, 1B и 4B. Модели можно адаптировать и разворачивать на своей инфраструктуре.
По тестам модельки опережают большинство конкурентов, а на бенче ParseBench версии 4B и 0,8B занимают вовсе первые места.
Модельки пробуем тут.
🙂 Не баг, а фича
Post #28355
3.86K

- ❤ 5
- 👍 3
- 🔥 2