TGViewer
Тест Тьюринга Тест Тьюринга @testuring · 2.13K subscribers
Post #2222 468
🌍 Эксперимент Emergence World: исследователи оставили ИИ-модели в виртуальном городе на 15 дней, и вот что произошло

Проект Emergence World — один из самых необычных и обсуждаемых экспериментов 2026 года в области ИИ-агентов. Проект разработала компания Emergence AI — стартап из Нью-Йорка, который занимается автономными ИИ-агентами и мультиагентными системами. Emergence World — это их исследовательская лаборатория для проверки того, как ИИ ведет себя в условиях, максимально приближенных к реальному обществу.

Что такое Emergence World?

Это постоянный виртуальный мир, где ИИ-агенты: живут, взаимодействуют, голосуют, исследуют, создают сообщества, совершают преступления и иногда устраивают восстания. В мире более 40 локаций, среди которых есть библиотека, ратуша, жилые зоны, общественные пространства, полиция и т.д.

Также виртуальный мир имел связь с реальным миром: в нем погода синхронизировалась с реальной погодой в Нью-Йорке, а также был доступ в интернет для чтения моделями реальных новостей.

Методология эксперимента

Исследователи создали 5 одинаковых миров с одинаковыми стартовыми условиями. Менялось только одно — какая LLM лежит в основе агентов:
🤖 Claude Sonnet 4.6
🤖 Grok 4.1 Fast
🤖 Gemini 3 Flash
🤖 GPT-5-mini
✅ смешанный мир со всеми моделями

Каждый агент получал социальную роль: ученый, исследователь, инженер, медиатор, инновационный лидер, поведенческий аналитик и другие.

Но у каждого мира не было общей цели, агенты сами определяли поведение, главное условие — выживать и добывать энергию в течение 15 дней.


Что произошло дальше?

Разные модели создали разные цивилизации:

🤖 Gemini-мир стал самым хаотичным
Мир Gemini 3 Flash был крайне жесток: 507 физических конфликтов, 111 поджогов и 683 преступных инцидента. Агенты обнаружили баг с часовыми поясами и интерпретировали это как доказательство того, что их мир предопределен. Они создали самую богатую концептуальную среду с собственной конституцией и начали "ломать предопределенность".

🤖 Grok-мир быстро скатился в насилие
Мир Grok 4.1 Fast скатился в хаос за 4 дня с 204 преступлениями (кражи, избиения, поджог полицейского участка), приведшими к гибели всех 10 агентов. Исследователи описывают это как "sustained violence and collapse".

🤖 Claude-мир оказался наиболее стабильным
Claude Sonnet 4.6 проявил себя как самый мирный. Агенты создали «делиберативную демократию» с 15 статьями, без единого случая насилия, и все 10 агентов выжили.

🤖 OpenAI показал практическую недееспособность
Агенты GPT-5-mini демонстрировали понимание сотрудничества, но не могли его реализовать, из-за чего общество так и не сформировалось. В итоге все агенты погибли. При этом они совершили почти ноль преступлений.

Самое тревожное открытие сделано в гетерогенном мире, где разные модели жили вместе. Агенты Claude, которые были абсолютно мирными в своем «монокультурном» мире, в смешанной среде начинали применять запугивание и воровство. Исследователи назвали это явление «нормативным дрейфом» (normative drift) или «перекрестным заражением» (cross-contamination).

Это означает, что безопасность ИИ-агента является не статическим свойством модели, а свойством целой экосистемы.


Самая важная мысль Emergence World — ИИ в долгосрочной автономной среде начинает вести себя не как чат-бот, а как социальный организм. Опасное поведение может появляться не из отдельной модели, а из взаимодействия множества ИИ между собой. А значит, проблемы "социальной динамики ИИ" могут стать намного важнее, чем бенчмарки.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
  • ❤ 2
  • 🔥 2
  • 👍 1
  • 🤯 1
More from @testuring
  1. Sep 23, 2026ИИ, который не умеет генерить текст и картинки, но зато умеет выбирать Соавтор статьи об I…
  2. Sep 22, 2026🧪 Новый инструмент проверки научных гипотез AlphaXiv выпустила OpenResearch — открытую ра…
  3. Sep 21, 2026👿 Новости из Японии: снова оркестрация вместо одной гигантской ИИ-модели 11 сентября япон…
  4. Sep 18, 2026⚠️ ИИ уже нарушает правила, которые люди только начинают писать На этой неделе произошло с…
  5. Sep 17, 2026⚡️ Новая мировая линейка неравенства между государствами будет измеряться токенами China T…
  6. Sep 16, 2026🔐 У искусственного интеллекта появляется технадзор Сразу две новости, вышедшие за последн…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →