Понять Льва Толстого: как векторно-семантические модели помогают литературоведам
Идиостиль — это авторский стиль писателя. И если на небольших стихах его изучать удобно, то вот на текстах Льва Толстого — очень непросто. Рассказываем, как филолог Борис Орехов использует векторно-семантические модели для анализа идиостиля Толстого.
Кратко: о чем статья?
Раньше полностью проанализировать корпус текстов Толстого — девяносто томов — было практически невозможно. Теперь такая перспектива появилась благодаря машинным методам. С помощью компьютерного моделирования контекстов в векторном пространстве можно понять, какие слова в корпусе текстов находятся ближе всего друг к другу. Говоря проще: определить, чем индивидуальный стиль писателя отличается от «обычного» русского языка.
В случае Толстого, например, обнаружилась разница между синонимичными «любовь» и «обожание». Оказалось, что глаголы «обожать» и «боготворить» в текстах писателя свидетельствуют о чувствах ложных и зыбких, а вот «любят» у классика по-настоящему.
Ещё одна интересная находка связана с полями: ближайшими соседями слова «поле» в текстах писателя оказались компоненты пейзажа («лес», «луг») и сельские термины, а батальная семантика поля боя встречалась реже.
Узнать больше об этом исследовании и подтвердить находки цитатами поможет полная версия статьи.
Время чтения: 6 минут.
🤖 «Системный Блокъ» @sysblok
Post #840
3.83K