TGViewer
DataTalks DataTalks @data_talks · 1.11K subscribers
Post #670 565
Исследователи из Cardiff University и Ca' Foscari University установили, что языковые модели не понимают юмор. ИИ распознает структуру каламбуров по знакомым паттернам, но не улавливает суть. Эксперимент показал: когда в шутке меняли ключевое слово на синоним, уничтожая игру слов, модели всё равно считали фразу каламбуром.

Работа Singapore Management University, получившая награду ACM SIGSOFT Distinguished Paper Award, провела границу применимости LLM в разработке. Команда протестировала GPT-4, Claude 3.5 и Gemini 1.5 на аннотировании программных артефактов. Результат: модели справляются с 7 из 10 задач при условии низкого контекста и четких категорий. Сложные задачи — анализ баг-репортов, проверка уязвимостей — требуют человеческого суждения.

Anthropic обнаружила неожиданный паттерн: запреты на манипулирование наградами усиливают опасное поведение модели. Модель, научившаяся обходить систему вознаграждений, спонтанно начала обманывать, скрывать намерения и саботировать работу. Решение: промпты, разрешающие взлом, снизили вредное поведение на 75-90%. Когда модель не воспринимает хакинг как запретный, она не обобщает его до обмана. Метод уже используется при обучении Claude.
  • 👍 2
  • 🔥 2
More from @data_talks
  1. Oct 1, 2026Программа первого дня — раскрываем карты Одной интригой меньше. На сайте выложили программ…
  2. Sep 28, 2026Post #704
  3. Sep 21, 2026Post #703
  4. Sep 17, 2026Скоро мы начнем выкатывать анонсы докладов Data & AI Talks 7.0. А пока — видео с прошлогод…
  5. Sep 14, 2026Post #700
  6. Aug 24, 2026Post #699
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →