Рубрика "Дивный новый мир"
The Financial Times: Anthropic заявила, что в этом году пресекла несколько попыток ученых использовать ее ИИ для исследований, способных помочь в создании биологического оружия. Компания привела пять случаев, когда пользователи обходили защитные механизмы и маскировали истинные цели работы. Некоторые относились к странам, доступ к моделям которым запрещен: России, Китаю и Ирану.
В отчете описан исследователь из «неподдерживаемого региона», который неделями планировал с Claude эксперименты с птичьим гриппом; фильтры безопасности ограничили его слабейшими моделями. Anthropic подчеркнула, что не может утверждать, будто эти ученые хотели навредить: те же данные нужны и для вакцин. Аккаунты заблокированы, названия институтов и стран не раскрыты.
На фоне опасений об угрозах ИИ для безопасности ранее ушел Джейкоб Коксон, заявивший, что сотрудники «искренне верят», будто ИИ может убить всех к концу десятилетия. Тревогу усилили продвинутые модели, а в июле OpenAI сообщила, что ее модели автономно взломали Hugging Face. Среди экспертов растет консенсус: биологическое применение ИИ нужно регулировать. Опасаются, что террористы, государства или одиночки создадут вирусы или оружие, хотя практические препятствия сохраняются.
В отчете также упомянуты мошеннические дейтинг-приложения, системы слежки за диссидентами и попытки семи китайских лабораторий, включая Moonshot и DeepSeek, воспроизвести технологии Anthropic через дистилляцию. Компания видит все более изощренные методы обхода защит и «сбора» возможностей американских топовых моделей.
@netlenkanet
Post #31341
25K

- 🤔 3
- 🤷♂ 2