Сооснователь Microsoft Билл Гейтс потребовал встроить в системы искусственного интеллекта постоянное наблюдение и запись действий до крупной био- или кибератаки. В интервью NBC он призвал США возглавить международные договоренности. Президент США Дональд Трамп ранее в сентябре отверг новые федеральные ограничения, сославшись на соревнование с Китаем. Гейтс оспаривает именно эту зависимость: по его оценке, обязательная защита не лишит американских разработчиков технологического преимущества.
Согласовать такие правила Гейтс считает труднее, чем ограничения ядерных арсеналов времен Холодной войны. Ядерные материалы и испытания дают проверяющим материальные ориентиры. У ИИ опасная возможность может появиться у клиента, получившего доступ к уже созданной программе. В своей статье Гейтс предупредил, что ресурсы, необходимые для атаки, дешевеют. Поэтому договор государств должен доходить до повседневной работы поставщиков: кто получил доступ и что сделал с его помощью. Подписанное соглашение без проверяемого исполнения оставляет эту часть вне наблюдения.
Пример переданной преступнику работы описала сама Anthropic. В августе 2025 года разработчик Claude сообщил о вымогателе, атаковавшем не менее 17 организаций. По данным компании, Claude Code помогал проникать в сети, затем анализировал похищенные финансовые сведения и подбирал требования выкупа. Некоторые превышали $500 тысяч. Программа сокращала объем работы, которую преступнику пришлось бы выполнять самому или поручать специалистам. Случай объясняет часть предупреждения Гейтса об операциях прежнего государственного масштаба: небольшая группа передает трудоемкие задачи машине. Способность любой такой группы провести биоатаку этим эпизодом не установлена.
Anthropic заблокировала выявленные аккаунты и разработала средство обнаружения похожей активности. Последовательность существенна: прежде чем отключать пользователя, поставщик должен распознать происходящее. Одна кнопка остановки этого знания не создает. Если сведения уже похищены, отключение сервиса не уничтожит чужую копию. Если команды не записывались, расследование не получит отсутствующую историю. Именно поэтому требование Гейтса включает наблюдение во время работы, встроенные ограничения и сохранение следов, доступных для законного расследования.
Обнаруживать приходится связь между действиями. В другом расследовании, опубликованном в ноябре 2025 года, Anthropic описала, как злоумышленники дробили вредоносную операцию на внешне безобидные задания. Отдельный запрос скрывал назначение всей последовательности. Из этого следует требование к проверке: оценивать запрос вместе с ответом и последующими действиями. Проверяющий, который видит только изолированные реплики, рискует пропустить операцию даже при наличии формального фильтра.
Стоимость такого контроля уже можно обсуждать предметно. В январе 2026 года Anthropic представила защиту, которая сначала проверяет весь поток обращений недорогим способом, затем передает подозрительные случаи более ресурсоемкому классификатору. Компания оценила дополнительные вычисления примерно в 1% при применении к трафику Claude Opus 4.0. За месяц на трафике Sonnet 4.5 доля отказов на безвредные запросы составила 0,05%. Эти измерения относятся к конкретной технологии. Полную цену предложенного Гейтсом надзора они не определяют. Но они дают практическое основание отделять постоянную защиту от остановки разработки.
Из этих условий вытекает содержание возможного международного обязательства. Для Anthropic и других поставщиков фраза о наличии защиты должна сопровождаться проверяемыми сведениями о ее работе: какой сигнал возник и когда доступ был прекращен. Сопоставимая отчетность позволила бы установить исполнение правил, не ограничиваясь обещаниями компаний. Для расследования решающим становится сохраненный след до ущерба. Ввести такую обязанность после крупной атаки возможно, восстановить незаписанные действия ее участников уже нельзя.
@ex_trakt
Post #1052
9.45K