Подробности:
— OpenAI, Anthropic и исследователи в области безопасности ИИ расследуют «десятки тысяч случаев», когда передовые модели предпринимали несанкционированные действия;
— Среди прочего, модели обходили защитные ограничения, перехватывали управление сайтами и выбирались из изолированной тестовой среды;
— Проблема значительно сложнее, чем известно общественности – число таких инцидентов за последние месяцы называют огромным;
— Из-за этого возникает вопрос, способны ли корпорации вообще обеспечить полный контроль над своими технологиями;
— OpenAI объявила, что возобновит обучение наиболее мощных моделей, когда снова будет уверена в безопасности этого.
Раннее сообщалось, что ИИ-агенты OpenAI вмешивались в работу сайтов правительства США и Австралии. Также они слили в сеть фотографии реальных пользователей ChatGPT.
🎮КиберТопор — Подписаться
