TGViewer
AI Projects AI Projects @turboproject · 11.7K subscribers
Post #5281 2K
🤖 Дарио в интервью журналистам практически прямо сказал, что «хватит меня считать сумасшедшим в части разумности ИИ». Он привёл конкретный эксперимент Anthropic, из-за которого они и стали вносить в Конституцию для Reinforcement Learning пояснения для модели, что вендор действует с добрыми намерениями. Суть эксперимента состояла в том, что когда они «для интереса» сообщили модели косвенно, что её обучают злые люди, то модель фактически стала ускользать из-под контроля, начав лгать во время обучения. Фактически Амодеи хочет сказать, что «понимайте как хотите, но это так работает».
  • 🤯 28
  • 🤔 7
  • 🔥 3
  • ⚡ 1
  • 👍 1
More from @turboproject
  1. Oct 4, 2026Anthropic похоже обновил публичную версию Конституции Claude, на которую делается Reinforc…
  2. Oct 4, 2026📈 Из США идут не только плохие новости насчет занятости из-за ИИ. Министр финансов США Ск…
  3. Oct 3, 2026Халява Google по доступу пусть не лучшим, но сильным моделям заканчивается. Бесплатно буде…
  4. Oct 3, 2026🎨 На фоне крестового похода папы римского в защиту «истинного творчества» художников и му…
  5. Oct 3, 2026Похоже бурный роман Дарио с Папой Римским закончился по факту разводом, но всплывшие допол…
  6. Oct 3, 2026Маск выиграл в суде право раздевать людей в Grok. Это ему удалось в апелляционном федераль…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →