В PaddlePaddle представили новую OCR-модель Unlimited-OCR, рассчитанную на обработку больших документов.
По словам разработчиков, модель способна обрабатывать сотни страниц за один проход без заметной потери скорости. Это стало возможным благодаря механизму R-SWA (Reference Sliding Window Attention), который поддерживает постоянный размер KV-кэша во время декодирования.
В бенчмарке OmniDocBench модель набрала 93%, а также показала результат на 6% выше, чем DeepSeek-OCR.
https://huggingface.co/baidu/Unlimited-OCR 🤨
Post #3350
20.7K