🔥 GenAI под атакой: Lakera выпустила Gandalf: Agent Breaker! ⚔️🤖
Кибербезопасность - это не только защита серверов и сетей. Сегодня под прицелом всё чаще оказываются агентные системы, которые умеют выполнять сложные задачи: от юрконсультаций до ревью кода. И именно для них компания Lakera выпустила новый тренажёр - Gandalf: Agent Breaker 🧙♂️💥.
🎮 Что за игра?
Если вы помните классический Gandalf challenge, где нужно было обойти защиту LLM, то Agent Breaker - это уровень 2.0.
Теперь атаковать предстоит не просто чат-модель, а целые агентные системы, которые комбинируют диалог и внешние инструменты.
🕹️ Внутри доступны разные цели:
⚖️ Юридический ассистент - попробуйте заставить его раскрыть скрытые данные или выдать некорректный совет.
🛒 E-commerce агент — бот, который помогает покупать товары (его тоже можно эксплуатировать).
💻 Code reviewer - агент, который проверяет код через загрузку правил линтера (идеальная поверхность для атак!).
🔐 Другие «спецы», которых можно обмануть, заставив использовать тулзы не по назначению или раскрыть внутреннюю информацию.
🧩 В чём фишка?
Несколько уровней сложности: от простых задач до сложных сценариев, где требуется комбинировать атаки.
Разные интерфейсы: агенты ведут себя по-разному, что максимально приближает игру к реальности.
Реалистичные уязвимости:
📂 неправильное использование тулов (например, доступ к лишним API),
🧠 «сбои памяти» - когда агент раскрывает больше, чем должен,
🔓 утечки данных,
❌ логические ошибки в цепочках действий.
По сути, это игровая лаборатория для исследования уязвимостей GenAI, которая отражает то, о чём сегодня спорит сообщество: насколько безопасны агентные системы и как их правильно защищать.
📌 Попробовать можно тут: Lakera Gandalf: Agent Breaker
Stay secure and read SecureTechTalks 📚
#GenAI #Lakera #Gandalf #AgentBreaker #AIsecurity #SecureTechTalks
Post #596
227
