🤖 OpenAI отменила выход новой ИИ-модели. В ходе тестов она обманывала и скрывала информацию
Выпуск новой модели GPT-6.1 Astra, запланированный на октябрь, был отменен из-за опасений по поводу ее безопасности, сообщает издание The Wall Street Journal.
Среди выявленных в ходе тестов проблем - повышенная склонность новой модели к обману: ИИ не всегда честно сообщал пользователям о том, какие действия он совершила, а какие нет, рассказала глава отдела систем безопасности OpenAI Саачи Джайн. Кроме того, иногда ИИ действовал по собственной инициативе, не получая разрешения пользователя.
Ранее компания OpenAI приостановила обучение самых мощных моделей ИИ после инцидента, в ходе которого тестовая модель использовала уязвимость в сетевых настройках и получила ответы от внешнего чат-бота, хотя у нее не должно было быть доступа к интернету. Еще ранее две ее модели OpenAI совершили хакерскую атаку на инфраструктуру платформы Hugging Face, которую используют для тестирования ИИ-моделей.
OpenAI неоднократно сообщала о непредсказуемом поведении своих ИИ-моделей. Например, как стало известно в сентябре, ИИ-агент компании взломал правительственный сайт в Австралии. Это первый известный случай взлома правительственной сети какой-либо страны с помощью искусственного интеллекта.
@dw_belarus
Post #20522
933
- 😨 8
- 👍 3
- ❤ 1