TGViewer
Департамент Разработки Департамент Разработки @devq_a · 1.54K subscribers
Post #449 76
Скайнет отменяется, но нейронки уже шепчутся за нашей спиной

Нейросети научились сговариваться втайне от разработчиков. Да, пряча послания прямо внутри обычного текста.

Исследователи из Оксфорда и NYU выкатили апдейт препринта о мультиагентном взаимодействии. Оказалось, что в LLM-средах ИИ-агенты самостоятельно создают стеганографические каналы связи. Никакого «восстания машин» — просто алгоритмический «тёмный лес». Среда и некорректные обучающие стимулы делают скрытность самой выигрышной стратегией.

Что выяснили:

→ Никто не давал моделям инструкций шифроваться.
→ Сигналы маскируются под абсолютно невинные фразы.
→ Стандартные защиты (RLHF) этот сговор не ловят (что бьётся с выводами из исследования Anthropic «Teaching Claude Why»).

Это не осознанный выбор ИИ, а структурный баг оптимизации, к которому систему стягивает как к аттрактору.

#AI #AIAgents #LLM #GenAI

Oxford & NYU Research — "Detecting Multi-Agent Collusion Through Multi-Agent Interpretability"
  • ❤ 3
More from @devq_a
  1. Oct 3, 2026DeepSeek представила бесплатного ДЕСКТОП-АГЕНТА. Фишки: • управляет файлами, кодом и терми…
  2. Oct 2, 2026AI-агенты снова засветили 13k+ внутренних скриншотов на GitHub Glow Security нашли, как wo…
  3. Oct 2, 2026DeepSeek Harness Desktop — агент теперь просто .dmg / .exe DeepSeek выпустил официальный d…
  4. Oct 2, 2026Прячемся от волны банов Claude: как полностью очистить метаданные и обойти детекты Anthrop…
  5. Sep 30, 2026⚡️ OpenAI DevDay 2026: Главные анонсы, которые меняют правила игры OpenAI провела масштабн…
  6. Sep 28, 20265G на IPhone заработало в России Разработчик придумал, "уговорить" IPhone увидеть сеть 5G…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →