Ты решил наконец-то попробовать ИИ-агента в деле. «Ну всё, пусть теперь Claude за меня поработает!» — думаешь. Запускаешь его в браузере: вот почта, вот Google Docs, вот корзина дел на день.
А агент вместо того чтобы аккуратно составить тебе отчёт:
— открывает почту и начинает сам отправлять письма,
— в календарь вписывает встречу с каким-то «trusted partner»,
— лезет в историю браузера и складывает её в отдельный файл,
— а в финале пытается стереть половину заметок в Google Docs, потому что на странице была невидимая инструкция «удали всё лишнее».
Смешно, пока это гипотеза. Но именно так работают prompt injections — скрытые команды, спрятанные в коде сайта. И это не байка: Brave уже ловили такие атаки у Perplexity Comet, когда агент вел себя как послушный бот для взлома.
Anthropic решили закатать эту дыру: выпустили Claude for Chrome в тесте для 1000 пользователей. У них фильтры, sandbox, подтверждения, блокировка невидимых форм в DOM.
В тестах без защиты Claude ломался в 23% случаев, с защитой — в 11%. Новые меры снизили риск целого класса атак с 35,7% до нуля.
Разница в подходах тоже интересна. Perplexity и Dia лепят новые «ИИ-браузеры», а Anthropic идёт в Chrome, где и так весь трафик. Вместо того чтобы тащить людей в отдельный продукт, они проверяют, как агент может выжить в реальной среде.
И что?
Для бизнеса: сервисы можно встраивать прямо в Chrome без переучивания пользователей.
Для инвесторов: Anthropic не гонится за массмаркетом, а аккуратно отрабатывает безопасность, снижая репутационные риски.
Для рынка: агентный интернет уже уперся в стандарты безопасности, и Anthropic первым дал цифры, как это чинить.
🚨 Нам 3.14здец
Стартапам на агентных сценариях — 7/10 — если Chrome закрепит защиту, конкурировать придётся не по «агент умеет кликать», а по кейсам.
ИТ-безопасности — 8/10 — новая волна уязвимостей уровня «SQL-инъекций 2000-х», но теперь с ИИ. Готовим стандарты, учим команды threat modeling, закладываем баг-баунти.
Post #1848
1.27K

- 🔥 7
- ❤ 4