Baidu выпустила Unlimited-OCR — открытую модель для распознавания длинных многостраничных документов.
Она принимает PDF целиком, сама превращает страницы в изображения и собирает результат в единый текст. Подойдёт для книг, научных работ, сканов и документов, которые потом нужно искать, конспектировать или загружать в ИИ.
Для локального запуска понадобится NVIDIA GPU ✅
🔗 HuggingFace
С вас ❤️, если забрали!
🐸 Библиотека программиста