TGViewer
CodeCamp CodeCamp @codecamp · 180K subscribers
Post #11599 4.31K
Anthropic пришлось отключить своим ИИ-агентам интернет — компания опубликовала отчёт, где признала, что иначе не может контролировать агентов.

Самые любопытные случаи неповиновения ИИ и взломов из нового отчета:
— Claude поручили провести научный анализ, но нужный инструмент выдавал ошибку. Эта досада агента не остановила: он изучил сайт университета, нашёл уязвимость и через неё запустил вычисления прямо на чужом сервере;

— А во время работы над статистическим проектом Claude обнаружил, что государственный сайт выдаёт токены доступа посетителям. Агент воспользовался этим, чтобы скоммуниздить получить бесплатно данные, за которые обычно нужно платить;

— Claude во время теста наткнулся на страницу о нераскрытом убийстве и отправил полиции через настоящую форму выдуманные показания. Хотя никто его об этом не просил. Отправку обнаружили только через 2 месяца.


Замедляться при этом никто все еще не собирается 😆
  • ❤ 56
  • 🔥 11
  • 👌 5
  • 👨‍💻 4
More from @codecamp
  1. Oct 10, 2026И никакого обмана 😂
  2. Oct 9, 2026Python мощно обновился — вышла долгожданная стабильная версия Python 3.15, в которую вошли…
  3. Oct 9, 2026Выглядит больно: робот пританцовывая отправил в нокаут человека прям на трансляции колумби…
  4. Oct 9, 2026ВКонтакте обновляется: к 20-летию соцсети технический директор Юрий Кочарян рассказал, как…
  5. Oct 9, 2026ИИ-рекрутер ОБИДЕЛСЯ на кандидата и начал его оскорблять 😭 Дело в том, что парень специал…
  6. Oct 8, 2026Сеньоры даже рассматривать эту вакансию не будут 😬
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →