«OCR по-русски»: как мы оценивали распознавание текста на сложных документах
Когда нужно превратить тысячи разнородных документов в машиночитаемый текст, “просто OCR” не работает. Мы сделали честное сравнение решений под русскоязычные документы: пайплайн, метрики, тесты на реальных сценариях, плюс свой движок. Где сильны классические OCR, где выигрывают VLM, и что выбрали мы — в карточках.
Post #167
727






- 💯 12
- 🔥 10
- ❤ 5
- ❤🔥 5
- 👏 5
- 🤓 5
- 👨💻 5
- 👍 4
- 🎉 4
- 🆒 2