TGViewer
False Positive False Positive @falseposi · 1.13K subscribers
Post #62 1.04K
Вы когда-нибудь задумывались, почему ChatGPT уверенно врет вам про диссертацию Адама Стоквилда (Adam Stockwild), которую тот никогда не писал, или почему 0.11 для LLM больше чем 0.9?

Почему языковые модели, датасет для обучения которых едва ли меньше знаний всего человечества, проводят фактчекинг на уровне раздолбаев с задней парты, которые любой ценой пытаются сдать школьный тест?

Всё дело в том, как обучают и оценивают большие языковые модели.

В эту пятницу разберём новую статью от OpenAI «Why Language Models Hallucinate?». Узнаем, как вознаграждение (reward) при обучении превращает ИИ в фабрику фейков, и как это можно исправить.

На встрече Андрей Яковлев, специалист отдела экспертизы MaxPatrol HCC, расскажет:
🛑почему даже идеальные данные не спасают от галлюцинаций;
🛑как бинарные метрики вознаграждают ложь;
🛑что нужно изменить в бенчмарках, чтобы AI был честнее.

📅 Ждём всех в Толке в пятницу, 28 ноября, в 15:00 MSK.
🔗 Ссылка для подключения: Ктолк

P.S.: Адама Стоквилда не существует 🙂

#reading_group #llm
  • 🔥 7
  • ❤ 5
  • 👍 4
More from @falseposi
  1. Sep 30, 2026К нам в сореву залетела дрозофила🪰 И она уже расследует инциденты лучше чем мы А чего доб…
  2. Sep 25, 2026False Positive pinned a photo
  3. Sep 25, 2026Никто: Абсолютно никто: ИИ-агент, увидев PowerShell на сервере: 🚨🚨🚨 ВЗЛОМ 🚨 ВСЁ ПРОПАЛ…
  4. Sep 24, 2026Попробовать атакующих агентов кстати сейчас самим можно и в лабах и на CTF. А как повторит…
  5. Sep 24, 2026Выкладываем запись RG Глеба Кумичева про то как агенты хакнули HF #reading_group #openai #…
  6. Sep 18, 2026Мы начинаем🤗
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →