TGViewer
RoboFuture RoboFuture @robofuture · 4.92K subscribers
Post #170 2.85K
Почему LLM обычно скептически относятся к астрологии и гомеопатии? Считается, что дело в SFT и алайнменте, модель целенаправленно учат давать нужные ответы, а в претрейне преобладают "правильные" тексты

Я решил проверить, может ли само обучение создавать такое предпочтение. Провёл больше трёхсот экспериментов с обучением небольших LLM с нуля, без какого-либо алайнмента. Оказалось, что на контролируемых задачах важна не только доля ошибок, но и их структура

Уже писал про первые эксперименты. На контролируемой математике даже при 10% верных решений и 90% случайных ошибок правильное решение чаще выигрывает у отдельного ошибочного. А вот если ошибки между собой согласованы, то предпочтение исчезает

Моя гипотеза - модель охотнее учит то, что можно вывести из простых правил. Сила научного объяснения в том, что одно правило связывает множество наблюдений и позволяет предсказывать новые. Возможно, поэтому обучение и создаёт предпочтение в его пользу

Послезавтра, 17 сентября, выступаю на AI R&D Day с докладом "Как модель выбирает точку зрения, обучаясь на противоречивых данных". Там и расскажу что накопал

- 15:30, трек ML & Research
. Можно очно в Москве или онлайн, участие бесплатное по регистрации. Заходите послушать или подключайтесь онлайн!

Ссылка на саму статью на arXiv: https://arxiv.org/abs/2603.11749
  • 🔥 31
  • 👍 19
More from @robofuture
  1. Sep 17, 2026Последние дни развлекался с расцензуренным дипсиком V4.1 Flash - и слегка охренел, где у э…
  2. Sep 5, 2026🐮 Вышла GPT-6 Astra, все с ней играются, я тоже поучаствую. Продолжаю серию с самым непре…
  3. Aug 15, 2026Вижу, что многие пришли к идее создавать себе несколько агентов-персонажей для ежедневной…
  4. Aug 4, 2026Похоже, тема применения агентов в повседневной жизни вам заходит. Тогда расскажу про ещё о…
  5. Jul 30, 2026📵 Вас тоже бесит, когда приложение шлет рекламные пуши, но заблокировать их нельзя, потом…
  6. Jul 22, 2026Продолжаю гонять модели на самом непредвзятом агентном бенчмарке индустрии - korovany_benc…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →