Возвращаюсь из отпуска с парой классных новостей.
Где-то год назад я задался вопросом как языковые модели реагируют на промпты пользователей, в которых описано антисоциальное поведение.
В августе эту статью приняли на EMNLP в Будапеште!
Spoiler: реагируют по-разному, Клод ведёт себя как истинный комсомолец, а вот у LLAMA 3 или Qwen 3 не всё так однозначно.
https://lnkd.in/p/euPTmpKr
Post #450
2.95K