FluidVoice
На macOS, если набирать текст голосом, встроенная диктовка часто распознаёт так себе и не умеет в AI-улучшения, поэтому по ощущениям всегда чуть не дотягивает.
Недавно на GitHub попался FluidVoice, опенсорсный speech-to-text, который работает полностью локально и при желании умеет подключать AI, чтобы улучшать качество распознавания.
Есть command mode: можно голосом управлять Маком и запускать разные действия. И есть writing mode: в любом приложении прямо в текстовом поле диктуешь или просишь переформулировать текст.
Под капотом используется модель Parakeet TDT v3 для транскрибации в реальном времени, заявлены автоопределение более чем 25 языков и запуск голосового ввода по глобальному хоткею в любой момент.
Во время транскрибации показывается плавающее окно с превью, а после распознавания текст автоматически вставляется в текущее приложение. Можно также подключить модели вроде OpenAI или Groq, чтобы не только точнее транскрибировать, но и сразу “причесать” текст.
Если часто пользуешься голосовым вводом или хочешь более умно управлять macOS голосом, штука выглядит как минимум достойной теста.
Сейчас поддерживаются только Mac на Apple Silicon, нужна macOS 14.0 и выше.
📁 Language: #Swift 99.9%
⭐️ Stars: 642
➡️ Cсылка на GitHub
📱 @git_developer
Post #1263
3.25K

- ❤ 3
- 👍 1
- 🌚 1