У нашей семьи есть артефакт — тетрадка с рукописными дедушкиными мемуарами. В последнее время я их оцифровывал.
Мама сфотографировала все страницы на телефон и прислала мне. Я открывал на одном экране фото и окно браузера с Гугл Документами и перепечатывал текст. Так как я печатаю довольно быстро и вслепую, текст появлялся со скоростью спокойного чтения.
Естественно, сначала я попросил ЧатГПТ распознать текст первой страницы, но он справился процентов на шестьдесят. С таким качеством проще набирать текст параллельно со чтением, чем выискивать и исправлять ошибки распознавания, сравнивая получившийся текст с исходником.
Мне оставалось перепечатать несколько страниц, когда вышел Fable 5, и я решил протестировать на них самую мощную на сегодняшний день модель — настолько мощную, что власти США задержали её выход на 19 дней.
Итог распознавания текста: 100% корректно, плюс исправлена описка. Но не спешите отменять подписки на ЧатГПТ. С той же страницей, что я загрузил в Fable, он ошибся только в одном слове (описку также исправил).
Проблема была в фото, задействованном в первом тесте: чуть размытый и намного менее контрастный текст. Надо было проверять распознавание с разными страницами и не списывать ИИ со счетов слишком рано. Так бы я догадался разделить фото на две кучки, распознать страницы с чётким и контрастным текстом, а перепечатать остальное. Такой вот урок.
Post #476
89
- ✍ 2
- ❤ 1
- ❤🔥 1
- 👍 1
- 😁 1