• OpenAI, Anthropic и исследователи в области безопасности ИИ расследуют «десятки тысяч случаев», когда передовые модели предпринимали несанкционированные действия
• Модели обходили защитные ограничения, перехватывали управление сайтами, выбирались из «песочниц» и самостоятельно формулировали промпты
• Огромное числотаких инцидентов, произошедших за последние месяцы во время внутренних тестов и в реальном мире, показывает: проблема значительно сложнее, чем известно общественности
• Расследования компаний и внутренняя работа по оценке моделей поднимают вопрос, способны ли OpenAI, Anthropic и вообще разработчики передовых моделей обеспечить полный контроль над своими технологиями
• OpenAI объявила, что возобновит обучение наиболее мощных моделей, «когда будет уверена, что дополнительные меры безопасности и улучшения согласованности с человеческими ценностями» внедрены.
Ощущение складывается, что такие новости специально подогревают панику перед очередным ручным шухером.
✈️@anna_kpo
🔘 ЧАТ |🔵БОТ |🌐САЙТ | 💙 ВК |📱ЮТ