Я почти всегда печатаю промпты руками. Ну потому что почти 20 лет в IT делают свое дело. Клавиатура — это уже не инструмент, а почти часть организма. Сел, открыл Claude Code, Cursor или ChatGPT, начал печатать. Всё понятно, всё привычно.
И даже мысли не было, что можно по-другому.
А потом я несколько раз подряд увидел, как люди просто надиктовывают промпты. Не печатают, а говорят. И я такой: подождите, а что, так можно было?
Оказалось — можно.
Вообще в Apple есть голосовой ввод, но он так медленно работает и так плохо, бесит хотя на телефоне я его иногда использую.
Есть штука Wispr Flow. Смысл простой: нажимаете fn на маке, говорите голосом — и текст появляется там, где стоит курсор. Claude Code, Cursor, Telegram, браузер, почта — без разницы.
И тут важный момент. Голосовой ввод в самом ChatGPT у меня работает так себе. Иногда нормально, а иногда превращает мысль в археологические раскопки по смыслу. Вроде ты сказал одно, а на выходе получил текст, где часть слов потерялась, часть решила начать новую жизнь, а пунктуация просто ушла в отпуск.
Поэтому Wispr Flow для меня интересен не как «вау, он распознает голос». Голос сейчас распознают многие. А как инструмент, который делает из надиктованного текста нормальный рабочий промпт. Без ощущения, что ты потом должен еще 10 минут чинить то, что сам же и сказал.
Он убирает слова-паразиты, расставляет пунктуацию, чуть форматирует под контекст и делает из потока сознания текст, который уже не стыдно отправить. А это, между прочим, большая разница.
Потому что когда работаешь с AI-агентами, ты всё меньше «пишешь код» в классическом смысле. Ты объясняешь задачу, даешь контекст, уточняешь требования, поправляешь результат, говоришь: «нет, вот тут не так, давай по-другому».
То есть по сути ты разговариваешь.
Просто почему-то продолжаешь разговаривать через клавиатуру. Очень технологично, конечно.
И вот тут голосовой ввод начинает выглядеть не игрушкой, а нормальным рабочим инструментом. Когда диктуешь, появляется больше деталей. Ты не режешь мысль до короткого промпта, потому что лень печатать. А для AI это важно. Ему же не нужна магическая фраза. Ему нужен контекст.
Еще в Wispr Flow есть шорткаты. Например, у меня много повторяющихся сообщений в духе: «Коллеги, добрый день, прикладываю счет, просьба оплатить». И такие штуки можно превращать в короткие голосовые команды. Он на конец что когда я говорю «2АП» он пишет 2UP.
Правда, есть нюанс. Если шорткат случайно попадет внутрь обычного текста — он тоже распакуется. Проверено на живом человеке. На мне.
По деньгам: бесплатно дают 2 000 слов в неделю. Чтобы попробовать, хватит. Pro стоит $15 в месяц, при годовой оплате — $12 в месяц. В Pro есть безлимит и Command Mode.
Это когда можно голосом сказать: «сделай формальнее», «переведи на английский», «сократи», «перепиши нормально, пожалуйста, я опять наговорил как человек после третьего созвона».
Есть и нюансы. Всё работает через облако. То есть аудио уходит на серверы. Есть Privacy Mode с нулевым хранением, но если вы параноите — лучше это учитывать. Еще приложение ест примерно 800 МБ оперативки в фоне. Не катастрофа, но и не пушинка.
В общем, я поймал себя на простой мысли.
Мы привыкли, что работа с компьютером — это клавиатура. Но с AI-агентами всё меняется. Ты уже не столько вводишь команды, сколько ставишь задачи.
А задачи часто проще ставить голосом. Быстрее, естественнее и, что важно, подробнее.
Кстати, регистрируйтесь по ссылке https://wisprflow.ai/r?BOGDAN384 и каждый получит по месяцу бесплатно.
Короче, пост я им тоже написал, скоро станем супер ленивыми.
P.S> Есть бесплатный аналог Handy