TGViewer
Machine learning Interview Machine learning Interview @machinelearning_interview · 30.3K subscribers
Post #3074 1.88K
Извлечь текст из PDF мало. LightOnOCR-3 достаёт ещё и данные из графиков 📄

LightOn выпустила семейство открытых моделей для обработки документов. За один проход они:

• распознают печатный и рукописный текст;
• сохраняют структуру страницы и координаты блоков;
• описывают изображения;
• превращают данные с графиков в таблицы.

Доступны три размера: 0,8B, 1B и 4B. Лицензия Apache 2.0 позволяет адаптировать модели и разворачивать их на своей инфраструктуре.

По тестам разработчиков, версия 4B набирает 86,3 на olmOCR-Bench, опережая Chandra 2, Mistral OCR 4.1 и dots.mocr. На ParseBench версии 4B и 0,8B занимают первые два места среди моделей в опубликованном сравнении.

Полезный инструмент для подготовки отчётов, сканов и технической документации к поиску, аналитике и RAG.

https://huggingface.co/blog/lightonai/lightonocr-3
  • 🔥 11
  • 👏 5
  • ❤ 3
  • 🤔 1
More from @machinelearning_interview
  1. Oct 9, 2026🧠 ИИ, который сразу выбирает ответ K2-Type-0.9B от IFM получает контекст в виде текста ил…
  2. Oct 8, 2026⚡ Liquid AI открыла веса двух моделей, которые принимают решения без генерации текста. d1…
  3. Oct 8, 2026Как мы перешли от CatBoost к нейросетям в рекомендациях Авито Рекомендации на главной дают…
  4. Oct 7, 2026🌍 Google Earth AI помогает прогнозировать вспышки заболеваний по данным о местности Модел…
  5. Oct 6, 2026🧮 Математика для ИИ на русском: от школьной базы до трансформеров и диффузии Бесплатный к…
  6. Oct 5, 2026Hugging Face исследовали multi-harness RL: обучение с подкреплением сразу через Claude Cod…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →