Представляю вторую свою программу. Это AI-помощник, который умеет анализировать содержимое экрана и преобразовывать голос в готовый текст.
По сочетанию Ctrl+O все экраны затемняются, после чего можно выделить любую область на одном из мониторов. Выбранный фрагмент отправляется AI-агенту, который анализирует его и объясняет, что на нём происходит, что означает увиденное и что с этим можно сделать.
По сочетанию Ctrl+Y открывается окно записи голоса (аналог SuperWhisper). После записи речь автоматически расшифровывается, дополнительно обрабатывается через AI и вставляется в последнее активное текстовое поле на компьютере.
В настройках можно задать способ обработки текста: исправление ошибок, изменение стиля, форматирование или перевод на любой язык. Например, вы говорите на русском, а в поле ввода сразу вставляется готовый текст на английском, японском или любом другом выбранном языке. То же самое работает и со стилем: обычную речь можно автоматически преобразовать в деловой текст, короткое сообщение, техническое описание и так далее.
Для работы с облачными моделями необходимо создать один или несколько бесплатных аккаунтов в Mistral и Groq, получить API-ключи и указать их в настройках программы. Groq используется для распознавания и обработки голоса, а Mistral отвечает за дальнейшую работу с текстом и AI-функциями. Для работы сервисов в России нужен VPN или прокси (можно указать в настройках).
При желании облачные сервисы можно вообще не использовать и подключить локальные AI-модели, чтобы обработка выполнялась непосредственно на компьютере. Whisper вшит по умолчанию.
Скачать:
https://drive.google.com/file/d/1LcWf6NKMEg-7JCEhph6zihn5gYYTlRmI/view?usp=sharing
#soft
Post #9
59


- ❤ 2