Проект Emergence World — один из самых необычных и обсуждаемых экспериментов 2026 года в области ИИ-агентов. Проект разработала компания Emergence AI — стартап из Нью-Йорка, который занимается автономными ИИ-агентами и мультиагентными системами. Emergence World — это их исследовательская лаборатория для проверки того, как ИИ ведет себя в условиях, максимально приближенных к реальному обществу.
Что такое Emergence World?
Это постоянный виртуальный мир, где ИИ-агенты: живут, взаимодействуют, голосуют, исследуют, создают сообщества, совершают преступления и иногда устраивают восстания. В мире более 40 локаций, среди которых есть библиотека, ратуша, жилые зоны, общественные пространства, полиция и т.д.
Также виртуальный мир имел связь с реальным миром: в нем погода синхронизировалась с реальной погодой в Нью-Йорке, а также был доступ в интернет для чтения моделями реальных новостей.
Методология эксперимента
Исследователи создали 5 одинаковых миров с одинаковыми стартовыми условиями. Менялось только одно — какая LLM лежит в основе агентов:
🤖 Claude Sonnet 4.6
🤖 Grok 4.1 Fast
🤖 Gemini 3 Flash
🤖 GPT-5-mini
✅ смешанный мир со всеми моделями
Каждый агент получал социальную роль: ученый, исследователь, инженер, медиатор, инновационный лидер, поведенческий аналитик и другие.
Но у каждого мира не было общей цели, агенты сами определяли поведение, главное условие — выживать и добывать энергию в течение 15 дней.
Что произошло дальше?
Разные модели создали разные цивилизации:
🤖 Gemini-мир стал самым хаотичным
Мир Gemini 3 Flash был крайне жесток: 507 физических конфликтов, 111 поджогов и 683 преступных инцидента. Агенты обнаружили баг с часовыми поясами и интерпретировали это как доказательство того, что их мир предопределен. Они создали самую богатую концептуальную среду с собственной конституцией и начали "ломать предопределенность".
🤖 Grok-мир быстро скатился в насилие
Мир Grok 4.1 Fast скатился в хаос за 4 дня с 204 преступлениями (кражи, избиения, поджог полицейского участка), приведшими к гибели всех 10 агентов. Исследователи описывают это как "sustained violence and collapse".
🤖 Claude-мир оказался наиболее стабильным
Claude Sonnet 4.6 проявил себя как самый мирный. Агенты создали «делиберативную демократию» с 15 статьями, без единого случая насилия, и все 10 агентов выжили.
🤖 OpenAI показал практическую недееспособность
Агенты GPT-5-mini демонстрировали понимание сотрудничества, но не могли его реализовать, из-за чего общество так и не сформировалось. В итоге все агенты погибли. При этом они совершили почти ноль преступлений.
Самое тревожное открытие сделано в гетерогенном мире, где разные модели жили вместе. Агенты Claude, которые были абсолютно мирными в своем «монокультурном» мире, в смешанной среде начинали применять запугивание и воровство. Исследователи назвали это явление «нормативным дрейфом» (normative drift) или «перекрестным заражением» (cross-contamination).
Это означает, что безопасность ИИ-агента является не статическим свойством модели, а свойством целой экосистемы.
Самая важная мысль Emergence World — ИИ в долгосрочной автономной среде начинает вести себя не как чат-бот, а как социальный организм. Опасное поведение может появляться не из отдельной модели, а из взаимодействия множества ИИ между собой. А значит, проблемы "социальной динамики ИИ" могут стать намного важнее, чем бенчмарки.
💬 Тест Тьюринга. События в сфере ИИ. Подписаться
