Может ли ЭЭГ действительно декодировать «чтение про себя»? Новая статья утверждает, что да, но, возможно, здесь только зрительные ответы.
В недавнем препринте сообщается о декодировании информации на уровне слов из ЭЭГ во время чтения про себя. Используя 49 часов данных от одного испытуемого и контрастивную модель в стиле CLIP, авторы сообщают о качестве декодирования выше случайного, лог-линейном масштабировании и устойчивости результата к удалению затылочных электродов.
Это впечатляющая инженерная работа. Но нет уверенности, что здесь действительно декодируется язык.
Главное опасение: в парадигме используется быстрое последовательное визуальное предъявление (RSVP). Каждое слово появляется в одном и том же месте экрана с одинаковым таймингом. Это повторяющийся, стереотипный зрительный стимул.
Рандомизация типографики (шрифт, размер, цвет) не решает проблему. Орфографическая форма — последовательность букв — всё равно остаётся. А длина слова напрямую коррелирует с длительностью предъявления (500–900 мс). Декодер может использовать низкоуровневые визуальные и временны́е признаки, вообще не затрагивая семантику.
Таким образом, утечки данных вполне реальны:
Более длинные слова → более длительные нейронные ответы, даже при фиксированных окнах анализа
Редкие буквы или необычные биграммы → выраженные ответы зрительной коры
Субвокализация → мышечные артефакты, коррелирующие с длиной слова и фонологией
Позиционные эмбеддинги в трансформере → авторы признают, что это объясняет ~35% прироста внутри прогона в контекстной конфигурации
Авторы, впрочем, проводят контрольные проверки: пермутационные базовые уровни, подмены с отслеживанием контекста, позиционные пробы, абляцию каналов. Всё это продумано. Но это не устраняет фундаментальную проблему: обработка зрительного стимула — это не декодирование языка.
Решающий тест — кросс-модальный перенос: обучить модель на чтении, протестировать на восприятии речи на слух. Если декодирование сохранится, значит, сигнал семантический, а не зрительный. Авторы это признают, но пока такой эксперимент не провели.
Пока этот тест не выполнен, заявления об «информации на уровне слов» и «чтении про себя» следует рассматривать как декодирование визуальной орфографии, а не семантическое декодирование языка.
В таких исследованиях нужна осторожность. Впечатляющие показатели с контрастивными моделями создают иллюзию, что мы декодируем смысл, хотя на самом деле это ответы на зрительные стимулы и тайминг.
https://arxiv.org/abs/2608.20186
#ЭЭГ #ИМК #Нейронаука #ДекодированиеЯзыка #ИнтерфейсМозгКомпьютер #Нейротехнологии #МашинноеОбучение #шишкин
Post #15995
383