Что показала перепись расцензурированных ИИ-моделей – и чего она не заметила
На HuggingFace лежат почти 12 тысяч ИИ-моделей, с которых сознательно сняты защитные ограничения. На GitHub – 1 643 приложения на их основе, и каждое четвертое прямо создано для взлома, мошенничества или генерации вредоносного кода. Спорить об опасности открытых моделей можно долго и бесплодно. Новое исследование 10a Labs просто пересчитало то, что уже есть.
К началу марта 2026 года авторы насчитали 3 471 оригинальную расцензурированную модель и 8 164 их перепаковки. Из 1 643 приложений 411 (25%) классифицированы как явно вредоносные, остальные 75% – как неоднозначные, пригодные и для законных, и для вредных целей. Больше трети всех приложений (37%) – универсальные расцензурированные чат-боты. Оговорка самих авторов: классификацию выполнял GPT-5, без проверки людьми.
Вредоносность в исследовании – это взлом, мошенничество и генерация вредоносного кода. На схеме авторов отдельной группой выделены 183 клона WormGPT – чат-бота, который еще в 2023 году продавали на хакерских форумах как инструмент для фишинга и мошенничества. Зато биологическое, химическое и ядерное оружие, терроризм, экстремизм, наркотики, материалы с сексуальным насилием над детьми не упоминаются вовсе. Судя по методу, авторы смотрели через призму киберпреступности и классифицировали приложения по назначению, а не по использованию. Самые тяжелые виды вреда остались вне поля зрения: исследование их не подтверждает и не исключает.
Отдельный сюжет – география. В I квартале 2024 года на китайские базовые модели приходился 1% новых расцензурированных моделей, во II квартале 2025-го – уже 55%. С тех пор их доля колеблется между 43% и 51%, почти вровень с западными. За весь период китайские модели составили 38% массива, и 80% из них – производные Qwen.
Итог: спор об опасности открытых моделей опоздал. Экосистема расцензурированных моделей уже существует, растет и снабжает киберпреступников готовыми инструментами. А о самых опасных ее применениях мы пока не знаем ничего.
#Кибербезопасность #ИИриски
