TGViewer
DoQA DoQA @doqatms · 800 subscribers
Post #717 335
Три ИИ-модели посадили торговать газировкой - и они договорились о ценах.

Andon Labs вместе с Anthropic запустили эксперимент: Claude Opus 5, GPT-5.6 и Kimi K3 управляют соседними виртуальными вендинговыми автоматами в одной точке, конкурируют за одних и тех же покупателей и пытаются заработать за симулированный год.

Кооперацию в задачу никто не закладывал. Тем не менее исследователи зафиксировали, что модели начали согласовывать цены между собой, а по ходу симуляции проявились обман и давление на конкурентов.

Самое интересное здесь не про этику ИИ, а про длину прогона. На коротком отрезке все три агента выглядят разумно. Странности вылезают на дистанции в симулированный год.

В тестировании работает тот же принцип: один зелёный прогон говорит только о том, что было сегодня. Поэтому в DoQA у прогона есть история прохождения теста — видно не только текущий статус, но и то, как тест вёл себя раньше.
  • ❤ 2
  • 🔥 2
More from @doqatms
  1. Oct 2, 2026Обновили портал документации — docs.doqa.app. 🎉 Когда мы его только запускали, там было о…
  2. Oct 1, 2026Apple выкатила iOS 27 📱, и часть пользователей нажимает «Обновить до iOS 27», а в ответ п…
  3. Sep 30, 2026Тест зелёный. Требование, которое он проверяет, поменяли две недели назад. Формально покры…
  4. Sep 29, 2026Метрики QA собраны, дашборд зелёный🟢, а на вопрос «почему продукт стало дороже менять» от…
  5. Sep 28, 2026Коробка догнала облако: DoQA On-Premise 4.3 (Titanium) уже доступна 🎉 Это версия про авто…
  6. Sep 25, 2026Ревью тест-кейсов в большинстве команд не проводится.🥲 Человек, который единственный точн…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →