Уведомление о поддерживаемой ветке
Оригинальный автор, Musharraf Omer (@mush42), объявил в списке рассылки NVDA Add-ons, что конфликты с коммерческими контрактами не позволяют ему продолжать поддержку этого дополнения с открытым исходным кодом. Эта ветка продолжает проект, чтобы дополнение работало в актуальных версиях NVDA, и включает обновления совместимости, а также исправления ошибок в менеджере голосов и драйвере синтезатора. Вся заслуга за оригинальную работу принадлежит Musharraf Omer.
Это дополнение добавляет нейронные голоса синтеза речи в NVDA. Оно предоставляет драйвер синтезатора для голосовых моделей Piper, которые работают полностью на вашем компьютере, а также менеджер голосов для загрузки и установки голосов. Для загрузки голосов требуется подключение к интернету, но для их воспроизведения оно не нужно.
Piper — это быстрая, локальная нейронная система синтеза речи, которая звучит отлично и оптимизирована для маломощных устройств, таких как Raspberry Pi. Вы можете послушать образцы голосов на странице Piper voice samples. Речь генерируется движком Sonata — кроссплатформенным движком на Rust для нейронных моделей TTS, разработанным Musharraf Omer.
Вы можете найти пакет дополнения в разделе Assets на странице релизов.
Дополнение является только драйвером и по умолчанию не содержит голосов. Вам необходимо загрузить и установить нужные голоса через менеджер голосов.
После установки дополнения и перезапуска NVDA дополнение предложит загрузить и установить хотя бы один голос, а также предоставит возможность открыть менеджер голосов.
Вы также можете открыть менеджер голосов из главного меню NVDA.
Обратите внимание, что мы рекомендуем выбирать голоса качества low или medium для ваших целевых языков, так как они обычно обеспечивают лучшую отзывчивость. Для дополнительной отзывчивости вы можете выбрать загрузку варианта fast для голоса, но это может немного снизить качество речи.
Вы также можете устанавливать голоса из локальных архивов. Получив файл голоса, откройте менеджер голосов, перейдите на вкладку «Установленные» и нажмите кнопку «Установить из локального файла». Выберите файл голоса и дождитесь его установки.
Откройте менеджер голосов из главного меню NVDA, выбрав пункт «Менеджер голосов Sonata...». Он содержит две вкладки: «Загрузка» и «Установленные».
Выберите язык из раскрывающегося списка «Язык», чтобы отфильтровать список «Доступные голоса», затем выберите голос для работы с ним.
Список «Установленные голоса» показывает каждый установленный голос с его вариантом, качеством и языком.
MODEL_CARD, поставляемый с голосом, в котором указано, откуда взяты данные для обучения и как он лицензирован. Не каждый голос включает такой файл..tar.gz или .tgz, который у вас уже есть.После установки из локального архива или удаления голоса дополнение автоматически перезагружает синтезатор, поэтому изменения применяются немедленно. После загрузки новый голос сразу появляется в менеджере голосов; если список голосов NVDA не обновился, перезапустите NVDA.
Когда в качестве синтезатора выбран «Нейронные голоса Sonata», в настройках речи NVDA (меню NVDA > Параметры > Настройки > Речь) появляются следующие параметры.
«Голос» отображает установленные голоса в формате «имя (язык) — качество».
«Вариант» переключает между стандартной и быстрой сборкой текущего голоса. Отображаются только те варианты, которые у вас действительно установлены.
«Диктор» применяется к голосам, обученным с несколькими дикторами; для голосов с одним диктором он не действует. Этот параметр также доступен в кольце настроек синтезатора.
«Скорость», «Громкость» и «Высота тона» работают так же, как и для любого синтезатора NVDA. Когда параметр «Ускорение темпа» выключен, ползунок скорости покрывает только нижнюю часть диапазона скоростей движка; его включение расширяет ползунок на весь диапазон, что позволяет достичь гораздо более быстрой речи.
«Коэффициент длины», «Коэффициент шума» и «Noise w» предоставляют доступ к собственным параметрам вывода модели Piper. Все три работают одинаково: ползунок имеет диапазон от 0 до 100, а значение 50 означает значение по умолчанию, заданное для голоса при обучении, поэтому возврат ползунка на 50 отменяет ваши изменения. Из этих трёх параметров только «Коэффициент длины» доступен в кольце настроек синтезатора.
Выше 50 ползунки масштабируются до удвоенного значения по умолчанию для «Коэффициента длины» и до трёхкратного значения по умолчанию для «Коэффициента шума» и «Noise w». Поскольку значение 50 всегда означает «значение по умолчанию для этого голоса», определённое положение ползунка сохраняет своё значение при переключении на другой голос.
Доступные в настоящее время голоса обучены с использованием свободно доступных наборов данных TTS, которые обычно имеют низкое качество (в основном аудиокниги из общественного достояния или записи исследовательского качества).
Кроме того, эти наборы данных не являются всеобъемлющими, поэтому некоторые голоса могут демонстрировать неправильное или странное произношение. Обе проблемы могут быть решены путём использования более качественных наборов данных для обучения.
К счастью, разработчик Piper и некоторые разработчики из сообщества слепых и слабовидящих работают над созданием голосов лучшего качества.
Sonata отсутствует в списке синтезаторов NVDA или не загружается. Две основные причины — отсутствие распространяемого пакета Visual C++, описанное в разделе «Требования» выше, и отсутствие установленных голосов — драйвер сознательно отказывается загружаться, если не находит хотя бы один голос. Откройте менеджер голосов из главного меню NVDA, установите голос и перезапустите NVDA.
Только что загруженный голос не отображается в списке голосов NVDA. Перезапустите NVDA. Загрузка обновляет собственный список менеджера голосов, но NVDA всё ещё может использовать набор голосов, загруженный при запуске.
Предпросмотр или список голосов завершается ошибкой подключения. Оба запроса выполняются через интернет. Проверьте своё подключение, затем используйте «Обновить список голосов» на вкладке «Загрузка», чтобы повторить попытку.
«Вы не можете удалить активный голос!» Переключите NVDA на другой голос или другой синтезатор, а затем удалите его.
Речь запускается медленно или заикается. Используйте голоса качества low или medium, а также рассмотрите вариант fast для вашего голоса. Модели более высокого качества требуют заметно больше времени на обработку каждой фразы.
Для любых других проблем журнал NVDA обычно сообщает, что пошло не так: меню NVDA > Сервис > Просмотр журнала.
Пожалуйста, сообщайте об ошибках и запросах на новые функции в системе отслеживания проблем этой ветки и прилагайте журнал вместе с версией NVDA и голосом, который вы использовали.
Авторские права © 2024, Musharraf Omer. Авторские права © 2026, Ali Ustek и участники этой ветки. Это программное обеспечение распространяется под лицензией GNU GENERAL PUBLIC LICENSE Version 2 (GPL v2).