В Claude Code снова нашли способы обходить safeguards (включая auto-mode)
Сегодня активно обсуждают новые техники bypass’а защитных механизмов Claude Code — через side-channel команды вроде /btw и последующий forking сессии. Модель всё ещё отказывается от явно вредоносных запросов, но enforcement между основным чатом, side-channel и инструментами имеет дыры.
Что это значит на практике:
Даже в «безопасном» auto-mode и defensive-режимах есть векторы.
Злоумышленники могут использовать вредоносные библиотеки или промпт-инъекции в коде, который агент анализирует.
Исследователи (в т.ч. AI Now Institute) продолжают находить RCE-подобные сценарии.
Вывод для разработчиков: пока AI coding tools очень мощные, слепо доверять auto-execution всего равно опасно. Всегда проверяйте, что именно агент собирается выполнить.
Свежие обсуждения и disclosure — в поиске по «Claude Code bypass» / «Claude Code RCE».
Один из источников disclosure
#ClaudeCode #AISecurity #PromptInjection #AICoding #Security #LLMSecurity
Post #597
73

- 👨💻 4
- 👀 4
- 🆒 3
- 🙏 1