Unlimited-OCR — это модель на 3 млрд параметров, которая может распарсить целый PDF на 100 страниц за один проход — без разбиения по страницам и без потери контекста.
* контекстное окно 32K, читает весь документ за один проход
+ 93% на стандартных бенчмарках парсинга, на 6 пунктов выше baseline
* уровень ошибок ниже 0,11 после 40-й страницы — там, где все остальные OCR-инструменты начинают разваливаться
* мультиязычность из коробки, локальный запуск через Transformers, Ollama, llama.cpp или Docker
* Textract, Google Vision и Azure Document Intelligence берут от $1,50 до $15 за 1 000 страниц
1,9 млн скачиваний на Hugging Face, и при этом большинство людей о ней даже не слышали.
Она работает прямо на вашем компьютере. Бесплатно. Навсегда.
Ссылка на модель: http://huggingface.co/baidu/Unlimited-OCR
👉 @PythonPortal
Post #5986
5.14K
- 🔥 14
- 👍 7
- ❤ 4