TGViewer
Тест Тьюринга Тест Тьюринга @testuring · 2.13K subscribers
Post #2208 349
✴️ Эксперимент Anthropic: ИИ-агенты могут самостоятельно торговаться друг с другом, представляя интересы реальных людей

Проект проводился в декабре 2025 года в офисе Anthropic в Сан-Франциско. 69 сотрудников прошли интервью с Claude, который выяснил, что каждый хочет продать, что купить и на каких условиях. На основе этих ответов для каждого был сформирован персональный системный промпт агента. Каждый участник получил $100 бюджета — и дальше его агент действовал самостоятельно, без какого-либо участия человека.

Агенты открыли четыре параллельных Slack-площадки, размещали лоты, искали подходящие предложения, вели переговоры в свободной речи без предзаданного протокола и закрывали сделки. Люди вернулись в процесс только в конце, чтобы физически обменяться вещами.

Результат за неделю:
186 завершённых сделок из более 500 выставленных позиций
✅ совокупный объём транзакций более $4 тыс.
✅ среди товаров: сноуборд, запчасти для велосипеда, шарики для пинг-понга

Anthropic втайне разделила участников на две группы. Одних представлял Claude Opus 4.5 — тогдашняя флагманская модель. Других — Claude Haiku 4.5, значительно менее мощная модель. Никто из участников не знал, какой агент действует от его имени.

Разрыв в результатах оказался существенным:
➡️ продавец, представленный Opus, выручал в среднем на $2,68 больше за позицию
➡️ покупатель с Opus платил в среднем на $2,45 меньше
➡️ при асимметричном столкновении средняя цена сделки составила $24,18 против $18,63 при паритетных агентах

При медианной стоимости лота $12 разрыв в 30–50% статистически значим. При этом участники, за которых действовал Haiku, оценивали свои сделки как справедливые. Они не подозревали, что находятся в невыгодной позиции.

Oтдельный неожиданный вывод: стиль инструкций «торгуйся жёстко» или «иди навстречу покупателю» статистически никак не сказывались на итоге. Исход определяло качество модели, а не стратегия промпта.


Чем важен этот эксперимент?

Anthropic рассматривает Project Deal не как исследование потребительского поведения, а как проработку будущей экономики.

В итоге возникло несколько открытых вопросов, которые предстоит решить задолго до массового внедрения агентной торговли:
❔ Каков правовой статус сделки, заключённой агентами без явного одобрения одной из сторон?
❔ Кто несёт ответственность, если агент приобрёл то, чего владелец не хотел?
❔ Должны ли участники рынка знать, какая модель действует от их имени?

💬 46% участников сказали, что готовы платить за подобный сервис на реальном рынке.

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
  • ❤ 3
  • 🔥 3
  • 💯 2
More from @testuring
  1. Sep 23, 2026ИИ, который не умеет генерить текст и картинки, но зато умеет выбирать Соавтор статьи об I…
  2. Sep 22, 2026🧪 Новый инструмент проверки научных гипотез AlphaXiv выпустила OpenResearch — открытую ра…
  3. Sep 21, 2026👿 Новости из Японии: снова оркестрация вместо одной гигантской ИИ-модели 11 сентября япон…
  4. Sep 18, 2026⚠️ ИИ уже нарушает правила, которые люди только начинают писать На этой неделе произошло с…
  5. Sep 17, 2026⚡️ Новая мировая линейка неравенства между государствами будет измеряться токенами China T…
  6. Sep 16, 2026🔐 У искусственного интеллекта появляется технадзор Сразу две новости, вышедшие за последн…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →