Подчеркивается, что риски, связанные с её моделями искусственного интеллекта могут демонстрировать "поведение, направленное на самосохранение", включая попытки "сопротивляться отключению", "скрывать или манипулировать информацией" и поведение, "напоминающее шантаж"
Разработка нами высокотехнологичных моделей, платформ и приложений, а также расширение областей их применения могут ещё больше увеличить риск того, что наши модели причинят вред— говорится в заявлении компании Anthropic.
Разработчики антропогенного и другого ИИ, включая OpenAI, подверглись критике после инцидентов, когда экспериментальные системы нарушали установленные ограничения, в том числе после сообщения о том, что модель OpenAI взломала базу данных австралийской системы здравоохранения.
✨ @russianexta_re