EasyVoice
Голосовой ввод в любое поле Windows
Задача
Встроенная диктовка Windows требует интернета и отправляет голос на сторону, а облачные сервисы распознавания — тем более. Офлайн-движки вроде Vosk и Whisper есть, но сами по себе они не умеют печатать текст туда, где вы работаете.
Что сделали
Распознавание идёт локально, на вашей машине, и результат сразу уходит в активное поле через системный ввод — приложению-получателю не нужно ничего знать о диктовке. Если офлайн-точности не хватает, тем же кликом переключаетесь на встроенный движок Windows.
EasyVoice живёт в системном трее и печатает распознанную речь в то поле, где сейчас стоит курсор, — в браузере, редакторе, мессенджере, где угодно. Текст дописывается по мере распознавания, а не появляется целиком в конце фразы.
Три движка, переключаются в меню трея
- Vosk — офлайн, есть русская модель, отдаёт промежуточные результаты прямо во время речи;
- Whisper (whisper.cpp) — тоже локально и точнее, работает по фразам с определением пауз;
- Win+H — обёртка над встроенной диктовкой Windows, нужен интернет.
Остальное
- индикатор микрофона в трее мигает красным, когда микрофон занят другим приложением;
- глобальная горячая клавиша и включение кликом по значку;
- модели скачиваются из меню, с прогресс-баром и автообновлением раз в сутки;
- один самодостаточный
EasyVoice.exe— .NET ставить не нужно; - настройки в
%APPDATA%\EasyVoice\settings.json, запуск при старте Windows — галочкой.
Требуется Windows 10 или 11. Логика вынесена в отдельную библиотеку и покрыта тестами.
Стек
Нужен похожий сервис?
Расскажите о задаче — оценю сроки и стоимость.