OpenAI создала ИИ-хакера для защиты других ИИ
OpenAI разработала ИИ-суперхакера под названием GPT-Red, чтобы тот искал уязвимости в других больших языковых моделях компании. Этот ИИ-«спарринг-партнёр» тренирует системы OpenAI, выявляя их слабые места для повышения безопасности.
Ирония в том, что для защиты одних из самых мощных ИИ-моделей пришлось создать другую, ещё более сложную и потенциально опасную систему, специально предназначенную для их взлома. Это похоже на то, как если бы для проектирования пуленепробиваемого стекла изобрели новую, более мощную пулю.
Такой подход отражает фундаментальный сдвиг в обеспечении кибербезопасности продвинутых ИИ: лучшая защита теперь, возможно, лежит не в превентивных мерах, а в активной атаке со стороны другого искусственного интеллекта.
Post #1659
23
