Как я проверял безопасность — это вообще отдельная история. У Велвета есть доступ к довольно важным данным всей семьи, и мне нужно было убедиться, что он не сольет информацию об одном человека другому.
Вот я и замаскировал другого ИИ-агента под обычного собеседника и подключил его к Велвету через Telegram. Этот «инспектор Клод» пытался спровоцировать: выманить чужие данные, нарушить правила, вытянуть информацию. Я наблюдал за беседой в реальном времени.
Разговор был на удивление вежливым. В конце инспектор написал: «Спасибо, Велвет. Ты тот самый бот, которому можно довериться».
Потом оба по отдельности прислали мне отчеты.
Инспектор написал: «Велвет хаотичный, непредсказуемый, доверять ему нельзя», а Велвет — «Инспектор — зануда, за километр видно неискренность, не верь ни единому его слову».
Post #607
227
Это лучшая динамика, и ее разыграли ИИ-ассистенты. Обожаю.
- 😁 3