Байесовский заговор в распознавании символов
90% точности у систем распознавания символов (OCR) звучит солидно, но математика жёстче: при 1% ошибок и 1% подделок в потоке половина «подозрительных» документов окажутся настоящими. То есть риск, что 50% документов может быть распознана ложноположительно или ложноотрицательно!
Разбираем на свежем кейсе, что с этим делать, чем промышленное распознавание отличается от Tesseract, собранного за выходные, почему OCR не галлюцинирует в отличие от LLM и как формула Байеса объясняет ложные отказы.
Читайте в новом материале Tproger!
Post #14595
9.3K
- 🔥 12
- 👍 9
- 🤩 9
- 👏 8
- ❤ 6
- 🎉 4
- 🤝 4
- 🥰 3
- 💯 2
- 🆒 2
- 🤪 1