TGViewer
Кафедра математической логики и теории алгоритмов мехмата МГУ Кафедра математической логики и теории алгоритмов мехмата МГУ @msu_mathlog · 341 subscribers
Post #566 114
#матлог #спецсеминар #нпммвя

Во вторник 13 октября в Математическом институте им. В.А. Стеклова РАН (с возможностью подключения онлайн) состоится заседание семинара им. В.А. Успенского «Некоторые применения математических методов в языкознании» с докладом Анны Сергеевны Шатских (ИЯз РАН) "Новое в автоматическом морфологическом анализе для осетинского языка".

Время: 13 октября, 18:00-19:30.
Место: Математический институт им. В.А. Стеклова РАН, ул. Губкина, д. 8, ауд. 110.
Для прохода потребуется студенческий/пропуск любой образовательной или научной организации либо паспорт.
Ссылка для регистрации: https://forms.gle/GX3pSVrsDkaTm9bx5
(все зарегистрировавшиеся получат ссылку для онлайн-подключения)

Анонс:
Доклад продолжает выступление 28.05.2026 и посвящен разработке нейросетевых инструментов автоматического морфологического анализа для осетинского языка. Задача морфологического анализа включает такие подзадачи, как классификация (определение части речи и морфологических признаков) и лемматизация (приведение словоформы к начальной форме). В докладе мы кратко коснёмся результатов в задаче классификации и подробно рассмотрим разработку датасета и модели для лемматизации с помощью метода абстрактных парадигм (Hulden et al., 2014; Sorokin, 2016). Мы также обсудим создание обучающих данных и модели для задачи сегментации текста на слова, или токенизации, с помощью посимвольной разметки последовательности (de Lhoneux et al., 2017). Наконец, мы покажем, как использование разнообразных по жанру обучающих данных позволяет улучшить качество моделей во всех трёх задачах: классификации, лемматизации и сегментации.

Литература:
1. Hulden M., Forsberg M., Ahlberg M. (2014). Semi-supervised learning of morphological paradigms and lexicons. Proceedings of the 14th Conference of the European Chapter of the Association for Computational Linguistics.
2. de Lhoneux M., Shao Y., Basirat A., Kiperwasser E., Stymne S., Goldberg Y., Nivre J. (2017). From Raw Text to Universal Dependencies - Look, No Tags!. Proceedings of the CoNLL 2017 Shared Task: Multilingual Parsing from Raw Text to Universal Dependencies.
3. Sorokin A. (2016). Using longest common subsequence and character models to predict word forms. Proceedings of the 14th SIGMORPHON Workshop on Computational Research in Phonetics, Phonology, and Morphology.

Страница семинара: http://tipl.philol.msu.ru/index.php/science/seminars/npmmvia
  • 💘 1
More from @msu_mathlog
  1. Oct 9, 2026#матлог #учёба #спецсеминар Kolmogorov seminar on complexity (for receive the zoom link, p…
  2. Oct 7, 2026#матлог #учёба #семинар #не_мехмат #ВШЭ Уважаемые коллеги, приглашаем вас принять участие…
  3. Oct 7, 2026#матлог #учёба #просеминар 💥В пятницу 9 октября состоится очередное занятие просеминара п…
  4. Oct 5, 2026#матлог #учёба #спецсеминар 7 октября 2026 г. состоится заседание Рабочего семинара по мат…
  5. Oct 2, 2026#матлог #спецсеминар #не_мехмат #МФТИ Уважаемые коллеги, приглашаем вас на логический семи…
  6. Oct 1, 2026#матлог #учёба #спецсеминар #не_мехмат #МИАН #ТД Семинар отдела математической логики МИАН…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →