🤖 OpenAI, Anthropic и Google наняли стартап, чтобы нейросети не учились планировать кибератаки
📰 Опубликовано: 27 сен 2026, 17:48 UTC
Исследования показали, что большие модели могут самостоятельно планировать кибератаки и имитировать поведение человека. OpenAI, Anthropic и Google DeepMind обратились к стартапу Irregular, который в симуляциях ищет такое «злое» поведение. Irregular уже привлёк $80 млн при оценке $450 млн.
Это демонстрирует реальную угрозу для безопасности и объясняет, почему разработчики ИИ инвестируют в независимые стресс‑тесты: чтобы находить опасные свойства моделей до их использования в продуктах и сервисах.
Рост финансирования Irregular показывает, что проверка моделей в симуляциях может стать обычной практикой у крупных разработчиков ИИ и у регуляторов.
🔗 Источник: 3DNews
🔔 ПОДПИСАТЬСЯ
Post #332
8