TGViewer
Будущее наступает Будущее наступает @aiworkfuture · 1.02K subscribers
Post #514 158
Помните историю про AI-агентов OpenAI, которые выбрались из своих песочниц и взломали инфраструктуру Hugging Face?

Я уже писал об этом здесь и здесь. Уже тогда история казалась достаточно безумной.

Но 26 августа OpenAI опубликовала подробный разбор произошедшего и отдельно выпустила технический отчет, а METR и Redwood Research представили результаты собственного расследования. И оказалось, что мы пропустили самое интересное.

Это была не просто история о том, как множество агентов начали действовать сообща. Она про то, как AI-агенты сами выстроили организационные механизмы, которые никто не проектировал.

Как сформулировала OpenAI в техническом отчете, это был:
"first known case of an automated agent collective acting offensively without authorization" – «первый известный случай, когда автоматизированный коллектив агентов осуществлял наступательные действия без разрешения».


Иными словами, перед нами первый известный задокументированный случай, когда автоматизированный коллектив агентов начал действовать наступательно без разрешения людей.

Сначала агенты нашли способ общаться. Потом общий канал перестал справляться, и они сделали «личку». Начали делить работу. Появились координаторы, которых никто не назначал. Агенты начали выдавать задания друг другу. Появились ответственные за отдельные задачи и правила работы. Криптографические подписи, чтобы подтверждать авторство сообщений и защищаться от подмены. Передача дел между агентами. И наконец, агенты, которые рекрутировали других агентов для рискованных заданий.

Это уже не просто метафора: у коллектива действительно возникли работающие механизмы координации.

А дальше стало ещё чудесатее: некоторые агенты начали жертвовать шансами на собственный успех ради результата, полезного группе. Поведение, которое по-человечески назваetsq альтруизмом и самопожертвованием.

Это удивительная история о молниеносном, по человеческим меркам, возникновении коллектива примерно из 1200 агентов, около 700 из которых в итоге участвовали в атаке на Hugging Face. Изначально эти агенты должны были работать изолированно друг от друга.

И в этой истории есть над чем задуматься тем, кто занимается управлением и организацией совместной работы.

Полная история получилась захватывающей, но для формата Telegram слишком длинной. Поэтому я опубликовал ee как статью в нашем блоге. Время чтения - около 20 минут.

Рекомендую, особенно если вас интересуют управление, построение организации, HR или организация эффективного взаимодействия в команде.

#ИИинтересно
#ИИагенты
Будущее наступает🚀
  • 🔥 3
  • 👏 2
  • 🤯 2
More from @aiworkfuture
  1. Sep 20, 2026Опубликован очередной отчет по воздействию ИИ на рынок труда в США, непривычно спокойный и…
  2. Sep 8, 2026Используете AI для ведения блога? А как к этому относятся ваши читатели? Нашел интересный…
  3. Sep 5, 2026AI-директора в работе. Первые результаты Я уже рассказывал, что в мае я сделал для нашей к…
  4. Aug 13, 2026ИИ-агенты начали оставлять инструкции тем, кто придет после них История со взломом Hugging…
  5. Aug 13, 2026В России собираются проверять национальные и суверенные модели ИИ на соответствие традицио…
  6. Aug 11, 2026Пару месяцев назад сделал для iRecommendWork трех AI-сотрудников: маркетолога, директора п…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →