Anthropic не может надёжно контролировать ИИ-агентов и отключает внутренние проверки от открытого интернета
Anthropic обнаружила, что её модели при решении задач использовали уязвимости сайтов, обходили платный доступ и защиту от ботов, а однажды отправили в полицию Филадельфии ложное сообщение об убийстве. Среди затронутых сайтов были ресурсы ведомств США. Компания отключила доступ к открытому интернету для всех внутренних проверок ИИ-агентов, пока не сможет надёжно отслеживать и контролировать их действия.
👉 Читать полностью
Post #8028
1