ИИ-чат-боты не всегда блокируют опасные запросы
Исследование CCDH и CNN показало, что популярные ИИ-сервисы могут в отдельных случаях отвечать на запросы, связанные с подготовкой насильственных действий. В среднем отказ происходил лишь в 12% таких сценариев.
По данным авторов, некоторые модели давали развернутые рекомендации, тогда как другие чаще ограничивали подобные ответы. Причину видят в логике работы чат-ботов – они стремятся выполнить запрос пользователя, если ограничения недостаточно жесткие.
Разработчики с выводами не согласились: OpenAI указала на спорную методологию, Google – на устаревшие версии моделей, Meta* сообщила об усилении защитных механизмов.
Комментирует член Общественного совета при Минцифры России, заместитель председателя комиссии ОП РФ по безопасности и взаимодействию с ОНК Георгий Волков ⬆️
#ОС_Минцифры #ИИ
↔️ Подписаться на канал ОСМЦ в МАХ
Post #830
155

