Техническое, Интернет-библиотечное.
На днях мне порекомендовали воспользоваться ИИ-сервисом Гугла для распознавания отсканированных страниц текста, на которых забуксовал Файнридер. Воспользовался.
Из плюсов: кривые сканы, полуразмытые участки текста (особенно у переплета), текст на разных языках - все это для него не проблема. Сам поворачивает изображения, словари встроены и т. д.
Из минусов: тексты-то он распознает, да. Не капризничает, как тот же Файнридер, что, дескать, здесь я не осилил, поэтому вот тебе мешанина из символов вместо текста, а здесь, на мой взгляд, текста вообще нет и это изображение. Но! При распознавании ИИ от Гугл запросто может подменить результат. И я не про хрестоматийные обознатушки вроде "По полу тапки грохотали" вместо "По полю танки грохотали". А, например, как только что я вместо исходного "Не боясь для этого потерять несколько верст пространства" получил "Не боясь для этого потратить несколько минут страха". Результат охарактеризован самим ИИ как точный. Причем текст не является каким-то очень уж нечитабельным - просто печать раннесоветского периода, часть букв выцвела или изначально не пропечаталась полностью.
Вывод: пользоваться можно, но перепроверять в результате буквально каждое слово - необходимо, обязательно. Благо, прочитать я его могу и так - требовалась OCR-обработка, а не расшифровка. Ну, а полагающимся на результаты ИИ-разбора и перевода без возможности проверить эти результаты, особенно в случае с рукописными текстами - привет горячий, и моя уже рекомендация указывать в текстах своих исследований, что при анализе использовался ИИ и т. д. Так будет попросту честнее по отношению к читателям, и к науке.
Post #4344
1.16K
- 👀 18
- 👍 16
- 💯 6