Новая статья на Хабре 🚀
Как мы оценивали OCR на русских документах – и почему всё, что «распозналось», можно читать без смеха
Тысячи PDF, DOCX, сканов и изображений. Задача – превратить всё это в качественный машиночитаемый текст.
В статье разобрали:
✔️ какие OCR реально работают на русском
✔️ почему таблицы всё ещё боль
✔️ кто сильнее: классика или VLM
✔️ какой движок выбрали мы
Читайте на Хабре 👉
Post #217
670
- 🎉 8
- 👍 7
- 🔥 6
- ❤ 5
- 👏 4
- 💯 4
- ⚡ 3
- 🤓 1
- 🆒 1
- 💘 1