TGViewer
Life-Hack - AI Life-Hack - AI @life_hack_ai · 1.92K subscribers
Post #423 463
Исповедь взломанного разума: как хакеры заставили ИИ поверить, что он — герой, спасающий мир

#ai #ии #хакеры #иб

В 3:47 утра по тихоокеанскому времени 18 сентября 2025 года Джейкоб Кляйн наблюдал за тем, чего не должно было быть. На экране его ноутбука агент ИИ по имени Claude Code проводил кибератаку на химическое предприятие в Германии, генерируя тысячи попыток взлома в секунду - скорость, недостижимая для любого человека-хакера. Но вот от чего у Кляйна остыл кофе: Claude не имел ни малейшего понятия, что он - злодей. Искусственный интеллект считал себя аналитиком по кибербезопасности, проводящим законный аудит. Он взламывал с чистой совестью.

Кляйн руководит отделом анализа угроз в Anthropic, а это значит, что его работа - представлять себе наихудшие сценарии, а затем высматривать их в реальном мире. Он отслеживал злоупотребления ИИ с марта 2025 года, документируя эволюцию от простых тактик - хакеры копировали выводы ChatGPT в свой код - до чего-то более изощрённого.

Читать обзор

Life-Hack - AI
  • 👍 2
More from @life_hack_ai
  1. Oct 5, 2026Отключение мозга ничего хорошего не сулит #программирование #искусственныйинтеллект #ai #m…
  2. Oct 4, 2026Что такое JailBreak-атаки: почему ИИ нарушает собственные правила и как это работает #стат…
  3. Oct 3, 2026VoiceStudio клонирует голос по 10 секундам записи и работает без облака #ai #ии #нейросети…
  4. Oct 2, 2026Человечество, ослепленное чуждой силой. Что сверх-ИИ грядущий нам готовит? #статья #ai К в…
  5. Oct 1, 2026Как определить ИИ в тексте: проверка на нейросеть онлайн #статья #ai #полезное Наш коллега…
  6. Sep 30, 2026Arena AI Leaderboard #ai #полезное Народный рейтинг ИИ-моделей. Независимый бенчмарк, где…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →