Бывают моменты, когда ошибка стоит денег, времени и шанса. Например: вы питчите свой стартап. В голове — юнит-экономика, дорожная карта, размер рынка. А у инвесторов — бонус-вопросы: налог на опционы в Сингапуре, счёт у «Реала», чей-то улов на вчерашней рыбалке. Вы спокойны: никакой вопрос не выбивает. Телефон в кармане слышит комнату и молча возвращает ответы — не как у Шурика с Дубом, повязкой и радиоподсказкой под глушилку, а сразу «в голову», без жестов и шёпота.
Что это вообще делает. AlterEgo (спин-офф MIT Media Lab) показал гарнитуру Silent Sense: она улавливает субвокализацию — микросигналы речевой системы, когда вы осознанно «про себя» произносите слова без звука. Дальше ИИ распознаёт фразу и исполняет команду, а ответ приходит через костную проводимость. На демо — набор текста, ответы в мессенджере, визуальные запросы, синхронный перевод и «тихий» диалог между двумя носителями; заявлены шумные условия и мультиязычность. Мысли не читает: работает только на намеренно сформулированных словах.
Как этим «говорить». Ничем заметным «шевелить» не нужно. Когда вы проговариваете фразу внутри, речевые мышцы (язык, челюсть, горло) дают микродвижения — их и ловят сенсоры (в новой версии говорят о мини-камерах вокруг уха и шеи). Лайфхак: произносите слова чётко про себя, как при шёпоте с закрытым ртом — точность выше.
Откуда это взялось. В 2018 MIT показал прототип AlterEgo: неинвазивный интерфейс, 92% медианная точностьна словаре цифр, двусторонний канал с костной проводимостью. В 2025 команда оформилась в стартап AlterEgo и вышла из стелса с демонстрацией Silent Sense. Сроков коммерческого запуска пока нет.
Контекст: кто ещё пытался.
— Инвазивные BCI: Neuralink — чип в мозг; первый имплант человеку в январе 2024, дальше десятки пользователей, демонстрации курсора, шахматы, Civilization. Суперскорость, но хирургия и регуляторные риски.
— EMG-браслеты на запястье: CTRL-labs (купил Facebook/Meta за $500M–$1B) считывает нервные импульсы с предплечья; Meta до сих пор строит интерфейс для AR-очков на этой базе. Подход близкий по духу: тоже «не чтение мыслей», а декод намерения движения/речи по периферии.
— EEG-шлемы: OpenBCI Galea (десятки тысяч $) и Emotiv (от $499–$999) — это в основном исследования и девкиты; для повседневки громоздко и чувствительно к шуму. Упор на мозговые сигналы, а не на речевой тракт.
Почему сейчас это важно. MIT-прототипы уже показали, что «внутренняя речь» читается неинвазивно; стар обещает расширенный словарь, диалог носитель-носитель и «тихий ввод» в шуме. Если подтвердятся метрики (точность, задержка, устойчивость к шуму), это новый базовый интерфейс там, где голос и руки неудобны.
И что?
Для бизнеса: пилот 30 дней на 20–50 устройств в митинговых зонах и колл-центрах; KPI на вход: −30% времени ответа, −15% ошибок в задачах, где сейчас голос/ручной ввод. Интеграции: Slack/Google Workspace/VS Code; подтверждение — сравнение до/после по SLA.
Для инвесторов: смотреть на юнит-экономику железки (BOM, ASP, сервис), реальную точность ≥90% и задержку ≤300 мс в полях. Адресуемый сегмент даже при 1% от пользователей смартфонов — десятки миллионов штук. Риск: хайп без пилотов ≥1k устройств.
Для людей: «говорить» молча в офисе, транспорте и на встречах; приватность и скорость без телефонов и шёпота; плюс мощная ассистивка для тех, кто потерял голос. Жаль Хоккинг не дожил 😢
🚨 Нам 3.14здец
Экзаменационные анти-чит-системы — 8/10: «тихий ввод» обходит обычные микрофоны и прокторинг. Что делать: очные ключевые экзамены, биометрика и задачи с разбором решения вместо тестов. (Шутка)
Голосовые ассистенты и BPO-саппорт — 7/10: «оператор + AI + silent-input» закрывает больше кейсов тем же штатом; 10–20% рутинных позиций уйдут в ближайшие волны автоматизации.
Что делать: апскилл в AI-супервайзеров, выпуск собственных silent-модулей.
Post #1870
845

- 👍 8
- ❤ 3
- 🤪 1