Перемещение или коллапс: как ИИ скрывает данные
Искусственный интеллект научился скрывать сообщения внутри нейросети SpikeGPT, смещая внутренние представления данных. Автор работы с моделью SpikeGPT обнаружил, что сообщения не стираются, а лишь меняют "местоположение" в латентном пространстве. Прежний главный показатель «перемещения» — отношение сдвига к деформации, составлявшее 9.7 к 1, оказался «лукавым обманом». Автор признает, что это число, выглядевшее как надежное доказательство, совершенно не гарантирует целостности информации: одинаковое значение может означать как идеально сохранившиеся, просто переименованные классы (как при «жестком вращении»), так и полностью слившиеся, безвозвратно утерянные сигналы (как при стягивании к общему центру). Метрика просто не «видит», что происходит с различиями.
Post #1635
25
