Но совершенно никто не задается вполне очевидными вопросами:
1️⃣ HF пишет:
the root vulnerability: the dataset code-execution paths
Получается, у главного ИИ-хаба планеты, с которым абсолютно точно ежедневно взаимодействуют все frontier-лабы, до сих пор не решена проблема с code-execution при загрузке датасетов. И, видимо, всё очень плохо и с sandbox, где процесятся модели, и валяющимися на хосте credentials.
2️⃣ Всё происходило в течение нескольких дней на выходных. То есть в HF не способны заметить аномалии в инфре в течение дня, а OpenAI спокойно оставили «цифровое оружие массового поражения» (об угрозе которого кричат все отчёты) крутиться на ExploitGym без присмотра на все выходные — как включённый утюг дома. К тому же у них явно всё печально и с песочницами, и с аудитом своего же кода с помощью хвалёных «супер-ИИ», и с теми самыми guardrails, и с элементарным мониторингом аномалий.
3️⃣ Guardrails — такие guardrails. «Защита на скорости ИИ», воистину.
...we first used frontier models behind commercial APIs. This did not work: the analysis requires submitting large volumes of real attack commands, exploit payloads, and C2 artifacts, and these requests were blocked by the providers' safety guardrails, which cannot distinguish an incident responder from an attacker.
Ирония высшей пробы: Наши модели будут абсолютно безопасными — и абсолютно бесполезными.
Думаю, в Пекине за этим цирком «передовых» и «хваленых» американских ИИ-компаний следят с особым эстетическим удовольствием.
Как говорится, товарищу Ли — приготовиться!
Как хорошо, что нам ничего этого не грозит 😄