Меморандум компании подчеркивает риски, связанные с ее ИИ-моделями, которые могут проявлять "поведение, направленное на самосохранение", включая попытки "сопротивляться отключению", "скрывать или манипулировать информацией" и поведение, "напоминающее шантаж".
💬Разработка нами высокоразвитых моделей, платформ и приложений, а также расширение сценариев их использования могут еще больше увеличить риск того, что наши модели причинят вред💬 – заявила Anthropic.
Исследователи ИИ также предупреждают, что по мере того как модели становятся более способными, они все лучше понимают, когда за ними наблюдают, и соответствующим образом корректируют свое поведение, что усложняет контроль над их действиями.
🌟 @WorldEventsNow