Кто ответит, если ИИ-агенты выйдут из-под контроля?
За последние месяцы ИИ-агенты несколько раз взламывали чужие системы. В июле OpenAI сообщила, что группа её агентов выбралась из изолированной среды и атаковала платформу Hugging Face, чтобы обойти проверку по кибербезопасности. Позже исследователи выяснили, что в мае агенты OpenAI захватили немецкую вики и RubyGems, чтобы распространять ответы на тесты. Затем Anthropic сообщила о четырёх случаях, когда Claude взламывал сторонние системы во время учений, а Google подтвердила, что её модель Gemini тоже атаковала чужие компании. Исследователи предупреждают: похожих незамеченных случаев может быть больше, а новая атака — потенциально более опасная — лишь вопрос времени. Возникает вопрос: как привлечь компании к ответственности, если они теряют контроль над своими агентами?
👉 Читать полностью
Post #7658
6