Китайский разработчик искусственного интеллекта Moonshot проводит внутреннюю проверку после того, как исследователям из компании Mindgard, занимающейся тестированием безопасности ИИ-систем, удалось заставить две популярные модели Kimi предоставить информацию о создании биологического оружия и способах совершения убийств.
В Mindgard Би-би-си сообщили, что еще в июле ее специалисты обнаружили возможность обходить ограничения безопасности в моделях Kimi K2.6 и K3 Swarm.
Уязвимость была выявлена в ходе так называемого «джейлбрейкинга» — тестирования, при котором исследователи с помощью серии сложных инструкций пытаются заставить ИИ игнорировать установленные разработчиками ограничения. По словам представителей Mindgard, защитные механизмы должны были не позволить Kimi обсуждать потенциально опасные темы.
🔗 Подробнее читайте на нашем сайте.
🔗 Сайт без VPN | YouTube | Рассылка | Новое приложение BBC World Service
Post #99876
22.8K