این مقاله (از کنفرانس emnlp2020) اومده تولید محتوای سمی (فحش و حرفهای جنسیتزده و اینا) توسط مدلهای زبانی را بررسی کرده؛ مواردی مثل دلایل بروزش، چارچوبی برای سنجش میزانش در مدل و دیتای آموزشی و اینکه آیا ممکنه که جلوش گرفته شه یا نه.
کد و دیتا و کلا همه چیز را در اختیار عموم گذاشتند.
موضوع عجیبیه که در کاربردهای تولید متن مثل چتباتها و … شدیدا مشکلساز میشه.
حداقل این بلاگشون و این رشته توییت را بخونید خوبه.
https://toxicdegeneration.allenai.org
https://twitter.com/ssgrn/status/1310970616682622976
https://arxiv.org/abs/2009.11462
#read
#paper
#blog
@nlp_stuff
Post #80
1.07K
