Уведомление о сопровождении этого форка
Первоначальный автор, Мушарраф Омер (@mush42), объявил в списке рассылки дополнений NVDA, что конфликты с коммерческими контрактами не позволяют ему продолжать сопровождать это дополнение с открытым исходным кодом. Этот форк продолжает проект, чтобы дополнение работало в текущих версиях NVDA, и содержит обновления совместимости вместе с исправлениями в менеджере голосов и драйвере синтезатора. Все заслуги за первоначальную работу принадлежат Мушаррафу Омеру.
Этот перевод может отставать от readme на английском языке.
Переименовано из Sonata Neural Voices в версии v4.0.0 по просьбе первоначального автора, в качестве условия для размещения в Магазине дополнений NVDA. То же дополнение, тот же сопровождающий, та же лицензия GPL v2.
Это дополнение добавляет в NVDA нейронные голоса синтеза речи. Оно предоставляет драйвер синтезатора для голосовых моделей Piper, которые работают полностью на вашем собственном компьютере, а также менеджер голосов для загрузки и установки голосов. Подключение к интернету нужно для загрузки голосов, но не для того, чтобы говорить ими.
Piper - это быстрая, локальная нейронная система преобразования текста в речь, которая отлично звучит и оптимизирована для устройств низкого класса, таких как Raspberry Pi. Послушать, как звучат голоса, можно на странице образцов голосов Piper. Речь генерируется движком Sonata, кроссплатформенным движком Rust для нейронных TTS-моделей, который разрабатывается Мушаррафом Омером.
Вы можете найти пакет дополнения в разделе assets на странице релиза
Дополнение представляет собой просто драйвер, по умолчанию оно не содержит голосов. Вам необходимо загрузить и установить нужные голоса из менеджера голосов.
После установки дополнения и перезапуска NVDA, дополнение попросит вас загрузить и установить хотя бы один голос, и предложит открыть менеджер голосов.
Вы также можете открыть менеджер голосов из главного меню NVDA.
Обратите внимание, что мы рекомендуем выбирать голоса качества low или medium для вашего целевого языка (языков), поскольку они обычно обеспечивают лучшую отзывчивость. Для повышения отзывчивости вы можете загрузить быстрый вариант голоса, заплатив за это несколько более низким качеством речи.
Вы также можете установить голоса из локальных архивов. Получив файл голоса, откройте менеджер голосов, на вкладке Установленные нажмите кнопку Установить из локального файла. Выберите файл голоса и подождите, пока он установится.
Откройте менеджер голосов из главного меню NVDA, пункт Менеджер голосов Dengjen.... В нём две вкладки: Загрузить и Установленные.
Выберите язык в списке Язык, чтобы отфильтровать список Доступные голоса, затем выберите голос, с которым хотите работать.
Прослушать образец воспроизводит короткий образец выбранного голоса, чтобы вы могли услышать его до загрузки. Образец передаётся из интернета, и ничего не устанавливается. Во время воспроизведения та же кнопка становится Остановить воспроизведение.Диктор рядом с кнопкой прослушивания доступен только для голосов, обученных с несколькими дикторами. Он выбирает, какой диктор используется в образце.Загрузить стандартный вариант и Загрузить быстрый вариант получают голос. Каждая кнопка отключена, если этот вариант уже установлен, а кнопка быстрого варианта также отключена для голосов, у которых его нет.Обновить список голосов заново получает каталог вместо использования копии, сохранённой в этом сеансе.Список Установленные голоса показывает каждый установленный голос с его вариантом, качеством и языком.
Карточка голосовой модели... показывает файл MODEL_CARD, поставляемый с голосом, в котором указано, откуда взяты данные для его обучения и на каких условиях они лицензированы. Он есть не у всех голосов.Удалить голос... удаляет выбранный голос после запроса подтверждения. Кнопка остаётся отключённой, пока у вас не установлено хотя бы два голоса, и она не удалит голос, используемый в данный момент.Установить из локального файла устанавливает голос из архива .tar.gz или .tgz, который у вас уже есть.После установки из локального архива или удаления голоса дополнение само перезагружает синтезатор, поэтому изменение применяется сразу. После загрузки новый голос появляется в менеджере голосов немедленно; если список голосов самой NVDA его ещё не подхватил, перезапустите NVDA.
Когда в качестве синтезатора выбран Dengjen Neural Voices, следующие параметры появляются в настройках речи NVDA (меню NVDA > Параметры > Настройки > Речь).
Голос перечисляет установленные голоса в виде имя (язык) - качество.
Вариант переключает между сборками Standard и Fast текущего голоса. Перечисляются только те варианты, которые у вас действительно установлены.
Диктор относится к голосам, обученным с несколькими дикторами; на голосе с одним диктором он ни на что не влияет. Он также доступен в круге параметров синтезатора.
Скорость, Громкость и Высота работают так же, как у любого синтезатора NVDA. Когда Повышение скорости отключено, ползунок скорости охватывает только нижнюю часть диапазона скорости движка; при включении ползунок распределяется по всему диапазону, что позволяет говорить намного быстрее.
Масштаб длительности, Уровень шума и Высота шума открывают доступ к собственным параметрам вывода модели Piper. Все три работают одинаково: ползунок идёт от 0 до 100, а 50 означает значение по умолчанию, с которым голос был обучен, поэтому возврат ползунка на 50 отменяет ваши изменения. Из этих трёх только Масштаб длительности предлагается в круге параметров синтезатора.
Масштаб длительности задаёт, насколько долго удерживается каждый звук речи. Высокие значения растягивают речь, низкие сжимают её. Это отдельный механизм от Скорости, и оба они складываются, поэтому обычно проще задавать быстроту с помощью Скорости и обращаться к этому параметру только если естественный темп голоса вам мешает.Уровень шума задаёт, сколько разнообразия модель вносит в тембр и интонацию. Высокие значения звучат выразительнее, но менее предсказуемо.Высота шума задаёт, насколько различается длительность отдельных звуков речи, что воспринимается как ритм. Высокие значения звучат менее механически, но могут смазывать артикуляцию.Выше 50 ползунки поднимаются до двукратного значения по умолчанию для Масштаба длительности и до трёхкратного для Уровня шума и Высоты шума. Поскольку 50 всегда означает значение по умолчанию именно этого голоса, одно и то же положение ползунка сохраняет свой смысл при переходе на другой голос.
Доступные на данный момент голоса обучены на основе свободно распространяемых наборов данных TTS, которые, как правило, имеют низкое качество (в основном это аудиокниги, находящиеся в открытом доступе, или записи исследовательского качества).
Кроме того, эти наборы данных не являются полными, поэтому некоторые голоса могут демонстрировать неправильное или странное произношение. Обе проблемы можно решить, если использовать для обучения более качественные наборы данных.
К счастью, разработчик Piper и некоторые разработчики из сообщества слепых и слабовидящих работают над обучением более качественных голосов.
Dengjen отсутствует в списке синтезаторов NVDA или не загружается. Две обычные причины - отсутствие пакета Visual C++, описанного выше в разделе Требования, и отсутствие установленных голосов: драйвер намеренно отказывается загружаться, когда не может найти хотя бы один голос. Откройте менеджер голосов из главного меню NVDA, установите голос и перезапустите NVDA.
Только что загруженный голос не предлагается в списке голосов NVDA. Перезапустите NVDA. Загрузка обновляет список самого менеджера голосов, но NVDA может по-прежнему использовать набор голосов, загруженный при запуске.
Образец или список голосов завершается ошибкой соединения. И то, и другое получается из интернета. Проверьте соединение, затем воспользуйтесь кнопкой Обновить список голосов на вкладке Загрузить, чтобы повторить попытку.
«Вы не можете удалить используемый в данный момент голос!» Переключите NVDA на другой голос или на другой синтезатор, а затем удалите его.
Речь начинается с задержкой или прерывается. Предпочитайте голоса качества low или medium и рассмотрите быстрый вариант вашего голоса. Модели более высокого качества требуют заметно больше вычислений на каждое высказывание.
Во всех остальных случаях журнал NVDA обычно указывает, что пошло не так: меню NVDA > Инструменты > Просмотр журнала.
Пожалуйста, сообщайте об ошибках и запросах новых возможностей в трекере задач этого форка, прилагая журнал вместе с версией NVDA и голосом, который вы использовали.
Copyright(c) 2024, Мушарраф Омер. Copyright(c) 2026, Али Устек и участники этого форка. Это программное обеспечение лицензируется на условиях GNU GENERAL PUBLIC LICENSE Version 2 (GPL v2).