ИИ-модели: взлом встроен в архитектуру
Полная защита больших языковых моделей (LLM) от взломов оказалась фундаментально невозможной. Это заключение представила команда исследователей на Международной конференции по машинному обучению, одной из ведущих мировых площадок по ИИ.
Проблема не в отдельных багах или известных методах атак, а в самой архитектуре LLM: их принципы работы содержат неустранимый изъян, который оставляет постоянную лазейку для манипуляций. Это ставит под сомнение безопасность всех ИИ-технологий, на которые сейчас возлагают огромные надежды, от систем поддержки клиентов до критически важных автопилотов и медицинских диагностов.
Попытки "залатать" модель будут лишь временными решениями, не устраняющими базовую, встроенную уязвимость.
Post #1760
20
