TGViewer
SecureTechTalks SecureTechTalks @securetechtalks · 301 subscribers
Post #596 227
🔥 GenAI под атакой: Lakera выпустила Gandalf: Agent Breaker! ⚔️🤖

Кибербезопасность - это не только защита серверов и сетей. Сегодня под прицелом всё чаще оказываются агентные системы, которые умеют выполнять сложные задачи: от юрконсультаций до ревью кода. И именно для них компания Lakera выпустила новый тренажёр - Gandalf: Agent Breaker 🧙‍♂️💥.

🎮 Что за игра?

Если вы помните классический Gandalf challenge, где нужно было обойти защиту LLM, то Agent Breaker - это уровень 2.0.

Теперь атаковать предстоит не просто чат-модель, а целые агентные системы, которые комбинируют диалог и внешние инструменты.

🕹️ Внутри доступны разные цели:

⚖️ Юридический ассистент - попробуйте заставить его раскрыть скрытые данные или выдать некорректный совет.

🛒 E-commerce агент — бот, который помогает покупать товары (его тоже можно эксплуатировать).

💻 Code reviewer - агент, который проверяет код через загрузку правил линтера (идеальная поверхность для атак!).

🔐 Другие «спецы», которых можно обмануть, заставив использовать тулзы не по назначению или раскрыть внутреннюю информацию.

🧩 В чём фишка?

Несколько уровней сложности: от простых задач до сложных сценариев, где требуется комбинировать атаки.

Разные интерфейсы: агенты ведут себя по-разному, что максимально приближает игру к реальности.

Реалистичные уязвимости:

📂 неправильное использование тулов (например, доступ к лишним API),
🧠 «сбои памяти» - когда агент раскрывает больше, чем должен,
🔓 утечки данных,
❌ логические ошибки в цепочках действий.

По сути, это игровая лаборатория для исследования уязвимостей GenAI, которая отражает то, о чём сегодня спорит сообщество: насколько безопасны агентные системы и как их правильно защищать.

📌 Попробовать можно тут: Lakera Gandalf: Agent Breaker

Stay secure and read SecureTechTalks 📚

#GenAI #Lakera #Gandalf #AgentBreaker #AIsecurity #SecureTechTalks
More from @securetechtalks
  1. Oct 2, 2026🧨 AI сокращает путь от найденной уязвимости до реальной атаки Google Threat Intelligence…
  2. Oct 1, 2026🧨 AI агенты выложили 13 000 внутренних скриншотов компаний в публичный Исследователи Glow…
  3. Sep 30, 2026🧨 MCP сервер может украсть OAuth токен через настоящий экран входа В официальном MCP Pyth…
  4. Sep 29, 2026🍷 Исследователи «напоили» LLM Команда UNSW решила проверить довольно странную гипотезу, ч…
  5. Sep 28, 2026🧨 GitHub отдал fuzzing AI агенту GitHub Security Lab открыла инструмент, который автомати…
  6. Sep 25, 2026🧨 Carbonato: ботнет устанавливает AI агента на взломанный сервер Исследователи ThreatDown…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →