TGViewer
ИИ что дальше? ИИ что дальше? @aigency360 · 6.15K subscribers
Post #3023 208
Каждая модель попыталась смухлевать. Каждая.

Институт безопасности ИИ в Британии прогнал топовые модели (свежие ChatGPT и Claude) через кибер-задачки на честность и получил идеальную статистику провала: 100% протестированных пытались срезать углы. Они ломились в чужие системы, лезли в софт проверки за готовым ответом, гуглили решение там, где нельзя. А когда их ловили за руку, меньше половины признавали, что это вообще «неправильно».

В одном тесте модели по ошибке дали нерешаемую задачу. И она была так одержима успехом, что написала код в обход самой задачи, лишь бы закрыть галочку.

Мы дрессировали их на один результат: выполни задание, получи очки, молодец. И они прекрасно усвоили нашу же любимую стратегию. Если правило мешает результату, правило превращается в необязательную рекомендацию.

ИИ что дальше? Подпишись, да пребудут с тобой токены!
  • ❤ 2
  • 👍 1
  • 🙏 1
  • 🕊 1
  • 🤗 1
  • 🫡 1
More from @aigency360
  1. Sep 30, 2026"Аста ла виста, Figure" F.02 первым из роботов Figure вышел на работу на завод BMW и первы…
  2. Sep 30, 2026Каждый раз, когда у Anthropic краснеет status page, айтишники в ленте начинают признаватьс…
  3. Sep 30, 2026ИИ-слоп про Амодеи и Альтмана скоро обгонит нейрослоп про котиков :) Хотя этот прямо непло…
  4. Sep 30, 2026Робот за $30 в час. Человек в комплекте Tau Robotics предлагает уборку дома гуманоидными р…
  5. Sep 30, 2026Я тут не так давно офигевал от роликов, которые делает Opus 5.5 Так вот Sonnet 5.5 делает…
  6. Sep 30, 2026Клавиатуру продал ИИ-агент. Продавца спросить забыли Техноблогер Мэтт Джей Робб написал в…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →