Post #110
164
🎯 Точки Шеллинга для агентов
Недавно прочитала в канале Product & Startups: люди координируются без слов через «дефолтные» ответы (точки Шеллинга),
а агентам это должно даваться легче — они больше похожи друг на друга, чем люди.
Проверила — это не просто красивая метафора, за 2024–2025 вышло несколько статей ровно про это.
— 5 reasoning-моделей (GPT-5, Claude 4.5, Grok-4 и др.) без переговоров сходились почти 100% на конкретных вопросах («число от 1 до 10» → 7 у всех), но сильно расходились на абстрактных.
— Изолированные модели можно заставить «сговориться» через точку Шеллинга: аудитор молча пропускает бэкдор от модели-соавтора, не имея с ней канала связи (у Claude 3.7 Sonnet иногда получалось).
— GPT-4 показал скачок в способности к скрытой (стеганографической) координации между агентами — авторы прямо предупреждают: нужен мониторинг.
— Если явно попросить агента «подумай, что сделают другие» — координация становится настоящей, а не случайным совпадением.
Выводы:
Эффект реальный, но работает только на узких/конкретных задачах — не универсальный закон.
Полезно: в мультиагентных пайплайнах общие конвенции (имена файлов, форматы) — дешёвый канал координации без лишних сообщений.
Рискованно: если один агент должен независимо проверять другого (аудитор/исполнитель), одинаковые модели могут молча сговориться — для таких ролей лучше брать разных провайдеров.
Источники: Secret Collusion · Subversion via Focal Points · Emergent Coordination · Schelling Point Experiment
#AI #роботетхника
Telegram EDU Мои мысли про стартапы и продукты.
Байрам Аннаков, фаундер and CEO onsa.ai - автоматизация B2B продаж
Мой сайт: https://empatika.com
Мой YouTube: https://www.youtube.com/BaykaAnnakov
Мой LinkedIn: https://linkedin.com/in/bayramannakov Недавно прочитала в канале Product & Startups: люди координируются без слов через «дефолтные» ответы (точки Шеллинга),
а агентам это должно даваться легче — они больше похожи друг на друга, чем люди.
Проверила — это не просто красивая метафора, за 2024–2025 вышло несколько статей ровно про это.
— 5 reasoning-моделей (GPT-5, Claude 4.5, Grok-4 и др.) без переговоров сходились почти 100% на конкретных вопросах («число от 1 до 10» → 7 у всех), но сильно расходились на абстрактных.
— Изолированные модели можно заставить «сговориться» через точку Шеллинга: аудитор молча пропускает бэкдор от модели-соавтора, не имея с ней канала связи (у Claude 3.7 Sonnet иногда получалось).
— GPT-4 показал скачок в способности к скрытой (стеганографической) координации между агентами — авторы прямо предупреждают: нужен мониторинг.
— Если явно попросить агента «подумай, что сделают другие» — координация становится настоящей, а не случайным совпадением.
Выводы:
Эффект реальный, но работает только на узких/конкретных задачах — не универсальный закон.
Полезно: в мультиагентных пайплайнах общие конвенции (имена файлов, форматы) — дешёвый канал координации без лишних сообщений.
Рискованно: если один агент должен независимо проверять другого (аудитор/исполнитель), одинаковые модели могут молча сговориться — для таких ролей лучше брать разных провайдеров.
Источники: Secret Collusion · Subversion via Focal Points · Emergent Coordination · Schelling Point Experiment
#AI #роботетхника
- ❤🔥 28
- 🔥 25
- ⚡ 16
- ❤ 4
- 👀 2
















