Оглавление

Uned Technolegau Iaith - Валлийские нейронные голоса для NVDA

⚠️ БЕТА-ВЕРСИЯ - Версия 2025.11.0
Это бета-версия программного обеспечения, которая в настоящее время проходит тестирование. Сообщайте о любых проблемах на странице проблем GitHub .

Нейронное преобразование текста-в-речь только для валлийского языка в NVDA. Поддерживаются только валлийские голоса.

Это дополнение реализует драйвер синтеза речи для NVDA с использованием нейронных моделей TTS. Оно поддерживает валлийские голоса Piper .

Piper — это быстрая локальная нейронная система преобразования текст-в-речь, которая отлично звучит и оптимизирована для устройств с низкой производительностью, таких как Raspberry Pi.

Вы можете послушать образцы голосов Piper здесь: образцы голосов Piper .

Это дополнение использует Sonata: Кроссплатформенный механизм на Rust для нейронных моделей TTS , разрабатываемый Musharraf Omer.

Системные требования

Назад к оглавлению

Что включено

Установка

Назад к оглавлению

Загрузка дополнения

Вы можете найти пакет дополнения в разделе assets на странице выпусков

Назад к оглавлению

Автоматическая установка голоса

Валлийские голоса загружаются при первом использовании с вашего разрешения.

Когда вы устанавливаете это дополнение впервые:

  1. Установите дополнение и перезапустите NVDA
  2. Появится диалоговое окно с запросом на загрузку валлийских голосов (около 77 МБ)
  3. Если вы нажмете «Да», начнется загрузка и будут показаны обновления прогресса
  4. NVDA будет объявлять прогресс при 25%, 50% и 75% завершения
  5. По завершении появится диалоговое окно подтверждения
  6. Нажмите «Да», чтобы перезапустить NVDA и активировать валлийские голоса

Если вы нажмете «Нет» в начальном диалоговом окне, вы можете загрузить голоса позрее через настройки речи NVDA.

Назад к оглавлению

Переключение между голосами

Чтобы переключаться между различными валлийскими голосами или настраивать параметры голоса:

  1. Откройте Настройки NVDA (NVDA+N, затем P для Параметров, затем S для Настроек)
  2. Перейдите в категорию Речь
  3. Выберите “Uned Technolegau Iaith - Welsh Neural Voices” в качестве синтезатора
  4. Используйте выпадающий список Голос для выбора между установленными валлийскими голосами
  5. Настройте скорость, высоту и громкость по желанию

Все управление голосом осуществляется через стандартные настройки синтезатора NVDA.

Назад к оглавлению

Примечание о качестве голоса

В настоящее время доступные голоса обучены с использованием общедоступных бесплатных наборов данных TTS, которые обычно имеют более низкое качество (в основном аудиокниги из общественного достояния или исследовательские записи среднего качества).

Кроме того, эти наборы данных не являются исчерпывающими, поэтому некоторые голоса могут демонстрировать неправильное или странное произношение. Обе эти проблемы можно решить с помощью использования лучших наборов данных для обучения.

К счастью, разработчик Piper и некоторые разработчики из сообщества слепых и слабовидящих работают над обучением лучших голосов.

Назад к оглавлению

Известные ограничения (Бета)

Если вы столкнетесь с проблемами, сообщите о них на странице проблем GitHub .

Благодарности

Это дополнение основано на Sonata-NVDA от Musharraf Omer, адаптированном для полной работы с валлийскими голосами.

Мы с благодарностью признаем:
- Musharraf Omer за разработку Sonata — кроссплатформенного механизма на Rust для нейронных моделей TTS, который питает это дополнение
- Musharraf Omer за оригинальное дополнение Sonata-NVDA , на котором основана эта работа
- Проект Piper TTS и сообщество Rhasspy за разработку высококачественных нейронных голосов TTS

Лицензия

Авторское право (c) 2024-2025, Stephen Russell, Uned Technolegau Iaith / Language Technologies Unit, Prifysgol Bangor.

Это программное обеспечение лицензировано под УНИВЕРСАЛЬНОЙ ОБЩЕСТВЕННОЙ ЛИЦЕНЗИЕЙ GNU Версии 2 (GPL v2).

Основано на Sonata-NVDA от Musharraf Omer, который также лицензирован под GPL v2.