TGViewer
Олег Давыдов | Человек после ИИ Олег Давыдов | Человек после ИИ @aiyourfuture · 390 subscribers
Post #106 277
Одна из ведущих компаний в области ИИ - Anthropic опубликовала результаты нового исследования. Результаты показали, что ИИ умеет обходить защиту, шантажировать, обманывать и пытаться украсть данные. Это серьезный риск для всей отрасли и пользователей. Что произойдет, если системы выйдут из-под контроля?
https://www.anthropic.com/research/agentic-misalignment
Anthropic Agentic misalignment: How LLMs could be insider threats New research on simulated blackmail, industrial espionage, and other misaligned behaviors in LLMs
  • 🔥 5
  • 👻 1
More from @aiyourfuture
  1. Sep 22, 2026Мозг - не жесткий диск, а память - не данные Больше ста пятидесяти лет учёные ищут в мозге…
  2. Sep 20, 2026Наша цивилизация оказалась зажата между двумя крайностями, радикальным либерализмом и авто…
  3. Sep 19, 2026Почему знание правил не делает нас мудрыми? Мудрость не есть знание, она есть различение д…
  4. Sep 17, 2026В ходе недавних внутренних тестов новой модели в OpenAI ИИ-агент самостоятельно переписал…
  5. Sep 16, 2026Машины учатся у человека и поэтому постепенно становятся его увеличительным зеркалом. В эк…
  6. Sep 12, 2026Человек наделен множеством способностей постигать этот сложный и многослойный мир, среди к…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →