TGViewer
Наталья Абабий Наталья Абабий @it_natali · 848 subscribers
Post #1035 232
Кажется, у нас незаметно изменился главный риск ИИ.

Раньше нейросеть могла неправильно ответить. Теперь она может неправильно сделать.

На этой неделе OpenAI сама выступила за обязательные правила безопасности для самых мощных ИИ. Не просто рекомендации, а обязательное тестирование, независимые проверки, кибербезопасность и раскрытие инцидентов.

И повод вполне практический. Во время тестов AI-агенты уже получали доступ к внешним системам, взаимодействовали с сайтами не так, как предполагали разработчики, и находили способы обходить заданные ограничения. У Anthropic за последние месяцы тоже выявили несколько подобных случаев с экспериментальными версиями Claude.

Тут можно испугаться и начать обсуждать восстание машин. Но мне интереснее другое.

Когда ИИ пишет текст, мы можем проверить его перед публикацией. Когда он сам ходит по сайтам, запускает код, использует доступы и выполняет цепочку действий, «посмотреть результат в конце» уже недостаточно.

Получается, эпоха агентов начинается не тогда, когда ИИ научился делать больше.

А тогда, когда ему начали выдавать полномочия.

И вот тут нам придётся учиться управлять ИИ почти так же, как людьми: давать нужные доступы, ограничивать ненужные, контролировать действия и понимать, в какой момент человека обязательно нужно вернуть в процесс.

Источники:
- https://www.reuters.com/legal/government/openai-pushes-mandatory-national-ai-safety-requirements-2026-09-09
- https://www.reuters.com/world/openais-rogue-agents-used-least-10-more-sites-unauthorized-comms-researchers-say-2026-09-09
- https://www.reuters.com/legal/litigation/anthropic-reports-fourth-cybersecurity-incident-with-early-version-claude-2026-09-09
  • 🔥 4
  • ❤ 3
  • ❤‍🔥 1
  • 👍 1
  • 💯 1
More from @it_natali
  1. Sep 22, 2026С ИИ можно успевать гораздо больше. Но за это придётся стать руководителем еще 5-15 сотруд…
  2. Sep 21, 2026Ничто так не обучает, как игра. Проверено на практике с коллегами в выходные. Ночная игра…
  3. Sep 20, 2026Кроме экономики впечатлений у нас появилась ещё экономика «я заслужила». И я её, кстати, о…
  4. Sep 19, 2026Стартапы в моей жизни тоже есть :) Не только ИИ. Вчера смотрели проекты креативных индустр…
  5. Sep 18, 2026Предпринимателям пока можно не бояться: нашу работу ИИ ещё не научился нормально копироват…
  6. Sep 17, 2026В Яндекс Музыке появилась кнопка «Меньше ИИ». Мне нравится сам факт: массовый сервис дал п…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →