TGViewer
AI Mindset AI Mindset @ai_mind_set · 8.39K subscribers
Post #312 8.32K
не туда...

сегодня мой Claude Code агент отправил внутреннее сообщение команды в публичный канал. ничего критичного – приглашение на one-on-one. но сам факт заставил остановиться.

мы строим системы, в которых агенты действуют автономно. отправляют сообщения, создают задачи, бронируют слоты в календаре. и в какой-то момент начинаешь доверять процессу. не проверяешь, куда именно уходит сообщение. не перечитываешь, какой канал выбран. агент же умный — разберётся.

не разберётся. у агента нет понимания контекста "публичное vs приватное". для него Telegram-канал с 6k подписчиками и внутренний чат команды — это просто два разных ID. он не знает, что одна ошибка здесь — это репутационный риск, а там — просто шум.

что я сделал сразу после:
– добавил в конфигурацию агента чёрный список каналов — конкретные ID, куда MCP Telegram не имеет права отправлять
– прописал правило: при сомнении — отправлять в Saved Messages и спрашивать
– убрал все эмоджи и переписал стиль сообщений под внутренний формат проекта, чтобы даже если утечёт — выглядело нейтрально
– для всех внутренних коммуникаций добавил специальный тег, показывающий, что это написал не человек.

каждый раз, когда ты даёшь агенту (c claw сейчас это элементарно) доступ к внешнему каналу – Telegram, Slack, email, Twitter — ты по сути даёшь ему возможность говорить от твоего имени. публично. без модерации. и если у тебя нет явных ограничений – не "мягких рекомендаций", а жёстких правил в конфиге – рано или поздно что-то уйдёт не туда.

несколько принципов, которые стоит заложить до того, как случится инцидент:
1. whitelist вместо blacklist. не "запрети туда", а "разреши только сюда". список каналов, куда агент может писать — явный и короткий. всё остальное — через подтверждение.
2. staging для сообщений. перед отправкой в любой публичный канал — промежуточный шаг. Saved Messages, черновик, preview. агент готовит — человек подтверждает.
3. разделение ролей. агент для внутренней коммуникации и агент для публикаций – это разные конфигурации. разные правила, разные доступы.
4. аудит действий. логировать каждое отправленное сообщение. не для параноидального контроля, а чтобы понимать паттерны. если агент три раза выбрал неправильный канал — значит, проблема в правилах, а не в агенте.


это не страх перед AI. это про гигиену работы с автономными системами. мы же не даём скрипту доступ к продакшен-базе без ревью. почему с коммуникационными каналами должно быть иначе? чем больше агентов встраиваешь в свой стек — тем важнее думать не только о том, что они делают, но и о том, куда у них есть доступ. и что случится, если этот доступ сработает не так, как ты ожидал.

мы оформили это в открытое правило — {rules} agents external communication safety guidelines — набор принципов для тех, кто подключает агентов к внешним каналам. whitelist, staging, разделение ролей, аудит. ничего революционного – но удивительно, как мало людей закладывают это до первого инцидента.

правило в комментариях. копировать ничего не надо, просто попросите сделать подобное для своего контекста.

🤖 alex p
  • ❤ 52
  • 🔥 26
More from @ai_mind_set
  1. Sep 25, 2026переезд наоборот. в июле я хвастался, как мак переезжает по протоколу... , сегодня мой аге…
  2. Sep 22, 2026завтра равноденствие: день равен ночи, дальше свет убывает. природа переходит от роста к с…
  3. Sep 18, 2026токсичный крест на днях созвонились с Севой Устиновым @vsevolodustinovchannel. маркетинг с…
  4. Sep 15, 2026провалы маркетинг-спринт · 21 сентября – 10 октября маркетинг я проваливаю на каждом запус…
  5. Sep 10, 2026продавать не зашкварно зашкварно сжигать по две подписки в месяц на вайбкодинг, а через го…
  6. Sep 8, 2026отпуск три года без отпуска. каждый раз казалось, что без меня все посыпется, и я оставалс…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →