Сегодня немного поиграл с шифрованием звука и наткнулся на кое-что интересное.
Оказывается, зашифрованный голосовой трафик можно частично восстановить — даже не ломая шифр. Речь про VBR-кодеки (Speex, SILK — это то что использует Skype/Telegram под капотом). Они кодируют разные фонемы с разным битрейтом, и это напрямую отражается в размерах пакетов.
То есть ты слушаешь зашифрованный SRTP поток, смотришь только на длины пакетов — и через HMM/ML восстанавливаешь фонемную последовательность. Работа Wright et al. (2010) показала это на реальном трафике. Точность распознавания отдельных команд на Amazon Echo — 92%+.
AES-GCM, ChaCha20 — не важно. Шифр тут вообще не при делах, течёт метаинформация.
FoxWG с этим справляется через padding мусором — размеры пакетов перестают коррелировать с фонемами, модель атакующего просто разваливается. По сути это traffic morphing, только встроенный в туннель.
Если интересно покопать тему глубже — погуглите "phonotactic reconstruction VoIP" и "VBR side channel". Там целый пласт исследований с 2007 года.
Post #181
302
- 🤔 3
- ❤🔥 1