Если вам понравилось это дополнение и вы хотите выразить благодарность Кварку, то сделать это можно переводом любой суммы на следующий кошелёк YooMoney:
https://yoomoney.ru/to/410012293543375
Драйвер VoskTTS для автономного синтезатора речи с открытым исходным кодом.
Модели можно устанавливать в виде отдельных дополнений.
Используемую движком модель можно выбрать из меню NVDA → Сервис → Настройки Vosk TTS.
Драйвер работает на 64-разрядной NVDA.
Синтезаторы требуют высокие вычислительные ресурсы.
Сайты синтезатора речи Vosk TTS:
https://github.com/alphacep/vosk-tts
https://github.com/alphacep/vosk-tts
Установите в систему вот эту майкрософтовскую штуку и перезагрузите компьютер. Vosk TTS должен появиться в списке синтезаторов.
https://aka.ms/vc14/vc_redist.x86.exe
На будущее настоятельно рекомендую установить ещё и 64-битную версию этого пакета:
https://aka.ms/vc14/vc_redist.x64.exe
У модели версии 0.10 требования к вычислительным ресурсам еще выше.
На моей машине первоначальная инициализация занимает около 30 секунд, вместо пяти секунд у версии 0.7.
Поэтому собирать дополнение с ней я не буду, но желающие могут запустить её самостоятельно.
Для этого сначала скачиваем архив с моделью:
https://alphacephei.com/vosk/models/vosk-model-tts-ru-0.10-multi.zip
Распакуйте этот архив в подкаталог
synthDrivers/VoskTTS/models
и отредактируйте файл:
synthDrivers/VoskTTS/init.py
заменив на строке 27 имя модели с “vosk-model-tts-ru-0.7-multi” на “vosk-model-tts-ru-0.10-multi”.
После перезагрузки NVDA драйвер должен без ошибок подхватить версию 0.10.
Примечание: В обязательном порядке нужна 64-битная NVDA. На 32-битной просто памяти не хватит.
В последних альфа-сборках NVDA разработчики, слава богу, одумались и убрали функционал получения описания изображений на основе локальной нейросети.
Побочным эффектом этого стало удаление из состава NVDA пакетов numpy и onnxruntime, которые необходимы для работы движков синтезаторов речи VoskTTS и SileroTTS.
Прикрепляю к данному сообщению новые версии драйверов соответствующих синтезаторов с включёнными в их состав numpy и onnxruntime, которые должны корректно работать в самых крайних тестовых версиях NVDA 2026.1.
В этой версии также убрана поддержка 32-разрядной NVDA из-за проблем с сильным торможением.
https://t.me/nvda_group/64388?single
Кварк: Вечер добрый.
Вот новая версия драйвера синтезатора Vosk TTS, который больше не включает модели синтеза речи.
Модели теперь можно и нужно устанавливать в виде отдельных дополнений.
Используемую движком модель можно выбрать из меню NVDA → Сервис → Настройки Vosk TTS.
В приложенном архиве «VoskTTS.zip», в подкаталоге models, представлены три примера таких моделей.
Модификация от: Beqa Gozalishvili.
Добрый вечер. в процессе приготовления портирования этого движка на sapi, решил использовать эту же библиотеку и в дополнении.
Так как драйвер был выложен в свободном доступе, решил поделится модификацией.
Этот драйвер работает только на 64-битной nvda
Вот новая версия Vosk TTS, в которой изменено разбиение текста на фрагменты перед передачей в модель.
Теперь разбиение по возможности выполняется по границам предложений, что в большинстве случаев должно улучшить интонацию синтезируемой речи.
Также добавлена поддержка знака ударения (символ U+0301).
Вот драйвер синтезатора Vosk TTS, приведённый в более менее приличный вид. В диалоге выбора синтезатора он так и называется - Vosk TTS.
Сразу предупреждаю, что из-за высоких требований по вычислительным ресурсам летать оно не будет. Одна только первоначальная инициализация модели у меня занимает около пяти секунд. Хотя голоса, конечно, звучат классно.
Кстати, на 64-разрядной NVDA синтезатор работает заметно шустрее. Для тестов, наверно, лучше всего брать последнюю альфа-сборку.