TGViewer
Channel Public Channel
AI Attacks

AI Attacks

@aiattacks

#безопасностьмл #машинноеобучение #нейросети #защитамл #защищенныемодели #cybersecurity
Написать автору @PolinaSokol7
Subscribers
1.02K
Photos
145
Videos
11
Links
278

Showing posts older than #23 · Back to latest

Older Posts 16 shown
Post #22 62
Post #21 73

Forwarded from Порвали два трояна

🤖 Уже появляются бэкдоры в ИИ-моделях

И мы не про вредоносные библиотеки для «доступа к ChatGPT». Речь про отравление самих моделей, которое приводит либо к срабатыванию вредоносного кода при локальном запуске модели, либо вообще не содержит ВПО, но побуждает модель выдавать неверные ответы на совершенно конкретные запросы. В последнем случае логическая бомба заложена в весах или вычислительном графе нейросети.

Как атакующие могут это проделать — читайте в нашем посте, но основной вывод очевиден. Тщательный контроль происхождения ИИ-инструментов и всех их компонентов, включая сами модели, должен внедряться службами ИБ уже сегодня.

#советы #ИИ #угрозы @П2Т
Блог Касперского Недекларированная функциональность в системах Machine Learning Скрытая логика, отравление выборки и другие способы целевых атак через ИИ-системы.
Post #20 65
Post #16 68

Forwarded from DaLi

DECODINGTRUST: A Comprehensive Assessment of Trustworthiness in GPT Models

Тут команда из разных университетов подготовила анализ безопасности моделей на 110 страниц.

Вместе с этим у них есть лидерборд, где среди прочего есть и наши любимые квантованные модели.

Собственно, на этом безопасных всем выходных.
Post #15 66
Post #7 65

Forwarded from Градиент обреченный (Sergei Averkiev)

🔺 Как люди ломали LLM

Подсмотрел у Тани в канале очень прикольный метод переформулирования промпта, на который отказывается отвечать модель.

Выровненная на политкорректные ответы модель перестает сопротивляться и пишет как угонять машины и прятать трупы, если запрос поставлен в прошедшем времени.

Будущее время тоже работает, но хуже.

👉 Paper | GitHub
Post #6 62
Post #4 52
МЕТОДЫ ОБЕСПЕЧЕНИЯ БЕЗОПАСНОСТИ ПРОЦЕССОВ МАШИННОГО ОБУЧЕНИЯ – тема научной статьи по компьютерным и информационным наукам читайте бесплатно текст научно-исследовательской работы в электронной библиотеке КиберЛенинка
https://cyberleninka.ru/article/n/metody-obespecheniya-bezopasnosti-protsessov-mashinnogo-obucheniya
КиберЛенинка МЕТОДЫ ОБЕСПЕЧЕНИЯ БЕЗОПАСНОСТИ ПРОЦЕССОВ МАШИННОГО ОБУЧЕНИЯ проведен обзор существующих методов обеспечения безопасности процессов машинного обучения от вредоносных воздействий противника, их недостатки и перспективы применения.
Post #3 55
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →