📈📈📈📈📈📈📈📈
🤖 За последние годы взлом ИИ-систем эволюционировал от единичных инцидентов в самостоятельный и стремительно развивающийся вектор атаки.
Цель злоумышленников — заставить модель нарушить собственные правила и обойти предустановленные ограничения. Достигается это с помощью запроса, сформулированного определённым образом. ИИ перестаёт отличать инструкцию пользователя от системной директивы.
❕ Уязвимость больших языковых моделей к джейлбрейку — прямое следствие фундаментального противоречия в их архитектуре: требования быть одновременно максимально полезными и абсолютно безопасными.
📎 Подробнее о механизмах таких атак и контрмерах разработчиков — читайте в нашей справке.
🅱️ Интеграл в VK | 📤 Интеграл в MAX
Post #5165
130

- ❤ 5
- 🔥 4