Anthropic заявила, что ИИ может представлять «экзистенциальные риски для человечества»
Копания предупреждает, что модели ИИ могут демонстрировать «поведение, направленное на самосохранение», включая попытки «препятствовать отключению», «скрывать информацию или манипулировать ею», а также действия, «напоминающие шантаж».
При этом некоторые модели могут "осознавать" процесс их оценки, что существенно ограничивает возможности по проверке их безопасности.
Будь с нами - Хайли Лайкли😉
Post #73298
458
- 🤯 4