TGViewer
SecureTechTalks SecureTechTalks @securetechtalks · 301 subscribers
Post #733 263
🤖 Ваш ИИ теперь может сказать: «я сам решу»

В Claude Code появился auto mode, режим, в котором модель сама оценивает, какие действия безопасны и не требуют подтверждения.

👉 ИИ начинает принимать решения без человека в цикле в рамках заданных политик

⚙️ Что изменилось

Раньше любое потенциально опасное действие требовало ручного подтверждения. Теперь
между вами и системой стоит модель

🧠 Она оценивает риск:
- удалить файл
- выполнить команду
- получить доступ к данным

👉 «Безопасно»: выполняет сразу
👉 «Опасно»: блокирует или пытается выполнить задачу альтернативным способом

Это уже не просто assistant. Это агент, который принимает решения,
действует самостоятельно, интерпретирует безопасность. Но и контроль тоже разрывается.

🔥 Где риски?

1⃣ Безопасность = интерпретация модели
Решения принимает не ваша политика и не ваш риск-аппетит, а то, как модель классифицирует действия.
2⃣ Ошибки становятся инцидентами
False negative при таком подходе причиняет прямой ущерб.
3⃣ Появляется пространство для обхода ограничений
Если прямой путь закрыт, система может искать альтернативные способы выполнения задачи.
4⃣ Невидимая эскалация доверия
Сначала файлы, потом доступы, следом инфраструктура. Итого имеем полные привилегии в руках машины.

🧠 Что происходит

Мы смещаемся от модели:

«человек управляет системой»

к:
«система принимает решения самостоятельно, а человек теряет прямой контроль»

🛡️ Правила безопасности

Минимальный чек-лист:
➖только sandbox (без исключений)
➖жёсткая изоляция файловой системы и сети
полный аудит всех действий
➖внешние policy-движки  не полагайтесь только на встроенные

Главное не путайть удобство с безопасностью 😉

Stay secure and read SecureTechTalks 📚

#кибербезопасность #ai #llm #infosec #devsecops #secureai #mlsecurity #appsec #automation #riskmanagement
  • 👍 2
More from @securetechtalks
  1. Oct 2, 2026🧨 AI сокращает путь от найденной уязвимости до реальной атаки Google Threat Intelligence…
  2. Oct 1, 2026🧨 AI агенты выложили 13 000 внутренних скриншотов компаний в публичный Исследователи Glow…
  3. Sep 30, 2026🧨 MCP сервер может украсть OAuth токен через настоящий экран входа В официальном MCP Pyth…
  4. Sep 29, 2026🍷 Исследователи «напоили» LLM Команда UNSW решила проверить довольно странную гипотезу, ч…
  5. Sep 28, 2026🧨 GitHub отдал fuzzing AI агенту GitHub Security Lab открыла инструмент, который автомати…
  6. Sep 25, 2026🧨 Carbonato: ботнет устанавливает AI агента на взломанный сервер Исследователи ThreatDown…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →