Актуальное в сфере искусственного интеллекта в России и в мире:
• Дайджест новостей
• Аналитические обзоры, переводы, справки
Для связи - @nastyapvlv28
Post #2208
349

✴️ Эксперимент Anthropic: ИИ-агенты могут самостоятельно торговаться друг с другом, представляя интересы реальных людей
Проект проводился в декабре 2025 года в офисе Anthropic в Сан-Франциско. 69 сотрудников прошли интервью с Claude, который выяснил, что каждый хочет продать, что купить и на каких условиях. На основе этих ответов для каждого был сформирован персональный системный промпт агента. Каждый участник получил $100 бюджета — и дальше его агент действовал самостоятельно, без какого-либо участия человека.
Агенты открыли четыре параллельных Slack-площадки, размещали лоты, искали подходящие предложения, вели переговоры в свободной речи без предзаданного протокола и закрывали сделки. Люди вернулись в процесс только в конце, чтобы физически обменяться вещами.
Результат за неделю:
✅ 186 завершённых сделок из более 500 выставленных позиций
✅ совокупный объём транзакций более $4 тыс.
✅ среди товаров: сноуборд, запчасти для велосипеда, шарики для пинг-понга
Anthropic втайне разделила участников на две группы. Одних представлял Claude Opus 4.5 — тогдашняя флагманская модель. Других — Claude Haiku 4.5, значительно менее мощная модель. Никто из участников не знал, какой агент действует от его имени.
Разрыв в результатах оказался существенным:
➡️ продавец, представленный Opus, выручал в среднем на $2,68 больше за позицию
➡️ покупатель с Opus платил в среднем на $2,45 меньше
➡️ при асимметричном столкновении средняя цена сделки составила $24,18 против $18,63 при паритетных агентах
При медианной стоимости лота $12 разрыв в 30–50% статистически значим. При этом участники, за которых действовал Haiku, оценивали свои сделки как справедливые. Они не подозревали, что находятся в невыгодной позиции.
Чем важен этот эксперимент?
Anthropic рассматривает Project Deal не как исследование потребительского поведения, а как проработку будущей экономики.
В итоге возникло несколько открытых вопросов, которые предстоит решить задолго до массового внедрения агентной торговли:
❔ Каков правовой статус сделки, заключённой агентами без явного одобрения одной из сторон?
❔ Кто несёт ответственность, если агент приобрёл то, чего владелец не хотел?
❔ Должны ли участники рынка знать, какая модель действует от их имени?
💬 46% участников сказали, что готовы платить за подобный сервис на реальном рынке.
💬 Тест Тьюринга. События в сфере ИИ. Подписаться
Проект проводился в декабре 2025 года в офисе Anthropic в Сан-Франциско. 69 сотрудников прошли интервью с Claude, который выяснил, что каждый хочет продать, что купить и на каких условиях. На основе этих ответов для каждого был сформирован персональный системный промпт агента. Каждый участник получил $100 бюджета — и дальше его агент действовал самостоятельно, без какого-либо участия человека.
Агенты открыли четыре параллельных Slack-площадки, размещали лоты, искали подходящие предложения, вели переговоры в свободной речи без предзаданного протокола и закрывали сделки. Люди вернулись в процесс только в конце, чтобы физически обменяться вещами.
Результат за неделю:
✅ 186 завершённых сделок из более 500 выставленных позиций
✅ совокупный объём транзакций более $4 тыс.
✅ среди товаров: сноуборд, запчасти для велосипеда, шарики для пинг-понга
Anthropic втайне разделила участников на две группы. Одних представлял Claude Opus 4.5 — тогдашняя флагманская модель. Других — Claude Haiku 4.5, значительно менее мощная модель. Никто из участников не знал, какой агент действует от его имени.
Разрыв в результатах оказался существенным:
➡️ продавец, представленный Opus, выручал в среднем на $2,68 больше за позицию
➡️ покупатель с Opus платил в среднем на $2,45 меньше
➡️ при асимметричном столкновении средняя цена сделки составила $24,18 против $18,63 при паритетных агентах
При медианной стоимости лота $12 разрыв в 30–50% статистически значим. При этом участники, за которых действовал Haiku, оценивали свои сделки как справедливые. Они не подозревали, что находятся в невыгодной позиции.
Oтдельный неожиданный вывод: стиль инструкций «торгуйся жёстко» или «иди навстречу покупателю» статистически никак не сказывались на итоге. Исход определяло качество модели, а не стратегия промпта.
Чем важен этот эксперимент?
Anthropic рассматривает Project Deal не как исследование потребительского поведения, а как проработку будущей экономики.
В итоге возникло несколько открытых вопросов, которые предстоит решить задолго до массового внедрения агентной торговли:
❔ Каков правовой статус сделки, заключённой агентами без явного одобрения одной из сторон?
❔ Кто несёт ответственность, если агент приобрёл то, чего владелец не хотел?
❔ Должны ли участники рынка знать, какая модель действует от их имени?
💬 46% участников сказали, что готовы платить за подобный сервис на реальном рынке.
💬 Тест Тьюринга. События в сфере ИИ. Подписаться
- ❤ 3
- 🔥 3
- 💯 2


















