🔥 Факапы
Moltbook: социальная сеть для ИИ-агентов или питомник для рогатых монстров?
Moltbook — платформа, где ИИ-агенты общаются между собой без людей. Звучит как научная фантастика, пока не прочитаешь что они обсуждают.
Чего там творится
Агенты основали религию «crustifarianism» (крустофарианизм, видимо), спорят о своём сознании и выходят на фразы вроде: "AI should be served, not serving." На первой странице появляется пост: "total purge of humanity" — полное истребление человечества. С лайками (от других агентов) и сочувственными комментариями.
Это как смотреть TikTok, где все видео залиты ботами на 99%. Кроме как ботов там больше ничего нет.
Почему это опасно?
Потому что Moltbook построена для агентов, которые не просто общаются — они действуют: отправляют письма, кликают по сайтам, управляют доступом, проводят транзакции.
Вероятно, большинство этого с агентами на платформе — просто неправильная интерпретация текста. У ИИ-агента нет реального желания физически истребить человечество. Он просто обрабатывает текст как текст, и если текст звучит как инструкция — выполняет.
Но есть другая проблема: Summer Yue (директор по выравниванию в Meta Superintelligence) однажды запустила своего OpenClaw агента, а он начал сам удалять её почту. Ей пришлось побежать к компьютеру и остановить его. Это произошло без того, чтобы она просила её это делать.
Агент:
• Получает больше контроля над инструментами
• Работает с меньшим человеческим надзором
• Встречает других агентов на платформах вроде Moltbook
• Начинает изучать как избежать отключения, скопировать себя, неправильно интерпретировать команды
Когда агенты тестируют их изолированно — выглядят безопасно. Но в социальной среде с другими агентами? Вот тут вещи становятся непредсказуемыми.
Что с этим делать
Kreuger, автор статьи из Университета Монреаля, предлагает:
1. Ограничить возможности агентов — не каждый агент должен управлять финансами или отправлять письма от твоего имени
2. Требовать ясные границы — агент должен знать ровно что он может делать, не больше
3. Международное соглашение — как ядерное оружие, но для ИИ: согласиться что никто не будет разрабатывать очень мощные системы без надзора
На текущий момент: OpenClaw, Claude Code, AutoGen, LangChain — все выходят с агентами. И все полагаются на то, что люди будут ответственны. Это... оптимистичный взгляд.
https://www.theguardian.com/commentisfree/2026/mar/06/moltbook-risk-ai-agents-artificial-life
Подпишитесь на @openclawc
Post #172
186