SoundWave (Преобразование текста в аудиофайл)

soundWave — это дополнение для NVDA, которое преобразует текст в аудиофайл с использованием установленных речевых движков. Оно может экспортировать аудио из буфера обмена, текстового файла или текста, введённого непосредственно в дополнении.

Быстрый старт

  1. Нажмите NVDA+Ctrl+=, чтобы открыть soundWave.
  2. Выберите синтезатор.
  3. При необходимости задайте базовую папку для записей. Это папка для сохранения по умолчанию; soundWave создаёт выходные папки внутри неё, используя ваши шаблоны именования.
  4. Выберите источник ввода: буфер обмена, текстовый файл, папку с текстовыми файлами или введённый/вставленный текст.
  5. Настройте синтезатор. Используйте кнопку Тест, чтобы предварительно прослушать выбранные настройки.
  6. Выберите имя выходного файла и формат.
  7. Дождитесь завершения рендеринга, затем просмотрите сводку.

В диалогах рендеринга soundWave нажмите F1, чтобы открыть это руководство. На панели soundWave в настройках NVDA перейдите к кнопке Справка или нажмите Alt+H. Элементы управления диалога содержат клавиатурные ускорители, например Alt+T для кнопки Тест.

Ввод и вывод

Ход рендеринга

Во время рендеринга soundWave показывает диалог прогресса с кнопкой Отмена и опциональными построчными деталями. Используйте Показать подробности, чтобы просмотреть текущий файл, фрагмент текста, затраченное время, длительность рендеринга и скорость преобразования, где это доступно. Длительное время отображается в минутах или часах, а не в сырых секундах.

Для долгих рендеров используйте Свернуть, нажмите Alt+M или Escape, чтобы скрыть диалог прогресса. Рендеринг продолжается в фоне, а скрытый диалог не отображается в Alt+Tab. Снова нажмите команду soundWave (NVDA+Ctrl+=), чтобы вернуть диалог прогресса. Рендеринг отменяется только при нажатии кнопки Отмена. Если другой диалог soundWave уже открыт, та же команда выводит его на передний план вместо открытия нового рендера.

Настройки

Откройте Настройки NVDA и выберите soundWave, чтобы задать параметры по умолчанию для будущих рендеров.

Шаблоны именования

Поля именования являются шаблонами. SoundWave заменяет каждый токен информацией из текущего рендера перед предложением папки или имени файла. Вы можете удалять токены, перемещать их, добавлять свои слова или изменять пунктуацию между ними.

Настройка| По умолчанию| Пример вывода| Что управляет ---|---|---|--- Шаблон папки одиночного рендера | %engine% - %voice% | Sonata - Kirsten Two En Medium | Папка, предлагаемая диалогом сохранения для буфера обмена, введённого текста или одного текстового файла. Шаблон имени файла одиночного рендера | %source% | Clipboard.wav | Предлагаемое имя файла для одиночного рендера. Шаблон пакетной папки | %engine% - %voice% | Keynote Gold - Fred | Выходная папка, создаваемая при рендеринге папки с текстовыми файлами. Шаблон пакетного файла | %number% - %source% | 03 - chapter three.wav | Имя файла для каждого файла в пакетном рендере.

Примеры именования

Шаблон| Пример вывода| Когда полезно ---|---|--- %engine% - %voice% | Orpheus - Synthetic Dave | Группирует вывод по синтезатору и голосу. %source% - %engine% | chapter one - SAPI5.wav | Оставляет источник первым, но при этом идентифицирует синтезатор. %number% - %source% | 01 - opening credits.wav | Сохраняет предсказуемый порядок пакетного вывода.

Значения токенов именования файлов Токен| Значение| Пример значения ---|---|--- %source% | Буфер обмена, введённый текст, имя исходного файла или имя элемента исходной папки. | Clipboard, Typed, chapter one или meeting notes %engine% | Имя синтезатора. | Orpheus, Sonata, SAPI5 или Pocket TTS %voice% | Выбранный голос, если soundWave может его определить. Если голос неизвестен, эта часть опускается. | Synthetic Dave, Kirsten Two En Medium или Fred %number% | Порядковый номер. Рендеры папок добавляют его автоматически; токен доступен для пользовательских шаблонов именования. | 01, 02 или 03

Параметры синтезатора

Синтезаторы предоставляют такие настройки, как голос, язык, вариант, скорость, темп, высота тона или громкость, где эти опции доступны. Большинство диалогов настроек включают:

Поддерживаемые синтезаторы

Синтезатор| Примечания ---|--- SAPI5 | Использует установленные голоса Microsoft SAPI5. 32-битные голоса SAPI5 поддерживаются через отдельный 32-битный вспомогательный путь, когда он доступен. Скорость, высота тона и громкость SAPI5 могут быть настроены в диалоге рендеринга. SoundWave запрашивает у SAPI формат вывода по умолчанию для выбранного голоса вместо принудительной фиксации частоты дискретизации, возвращаясь к 22.05 кГц 16-бит моно только если SAPI не предоставляет формат. googleTtsForNvda | Требует дополнение Google TTS For NVDA и установленные пакеты голосов Google. SoundWave захватывает сгенерированный PCM-аудио от дополнения напрямую во время рендеринга. Кнопка Тест рендерит короткий образец во временный WAV и воспроизводит его, избегая живого речевого пути NVDA. SoundWave отображает только те голоса Google, которые установлены и надёжно работают через этот offline-путь рендеринга, поэтому его список может быть короче полного каталога голосов дополнения Google. Pocket TTS | Требует дополнение Pocket TTS. SoundWave рендерит меньшими сегментами, когда это необходимо, чтобы длинный текст с меньшей вероятностью превысил лимиты модели. Если модель сталкивается с известной ошибкой нулевой длины состояния трансформера, soundWave безопасно повторяет только этот сегмент меньшими частями, не сохраняя частичное аудио. Диалог опций включает настройку чувствительности к концу предложения Pocket TTS и параметр Flow steps, когда установленный синтезатор их предоставляет. Flow steps управляет количеством проходов уточнения модели от 1 до 10; 10 — полное качество по умолчанию, меньшие значения могут рендерить быстрее с менее стабильной речью. Supertonic | Требует дополнение Supertonic. SoundWave использует меньшие фрагменты для Supertonic, чтобы избежать ошибок размера модели на длинном входном тексте. Sonata | Требует дополнение Sonata Neural Voices и доступные конфигурационные файлы голосов. Eloquence и IBMTTS | Доступны при установке соответствующего дополнения для NVDA. SoundWave автоматически определяет речевой движок и предоставляет опции голоса и скорости перед рендерингом. Orpheus | Требует, чтобы Orpheus был текущим синтезатором NVDA перед началом рендеринга. Язык, голос, скорость, высота тона и громкость могут быть настроены перед рендерингом. Во время рендеринга soundWave временно переключает NVDA на доступный резервный синтезатор. Orpheus Classic | Доступен при установке дополнения Orpheus Classic. SoundWave использует выделенный путь захвата для этого старого синтезатора, чтобы длинные паузы и знаки препинания не приводили к усечённому выводу. Prose 2000 | Доступен при установке дополнения Prose 2000. SoundWave рендерит через независимый хост Prose вместо перехвата глобального аудиовыхода NVDA. Скорость, ускорение скорости и громкость применяются без изменения активного синтезатора NVDA. DECtalk и Keynote Gold | Доступны при установке и обнаружении требуемого дополнения. Keynote Gold предоставляет в диалоге рендеринга язык, голос, скорость, высоту тона, громкость и ускорение скорости. Кодировка, частота дискретизации, обработка чисел и управление движком зависят от установленного дополнения BestSpeech. Другие синтезаторы NVDA | SoundWave может рендерить многие другие установленные синтезаторы NVDA, когда они используют обычный путь вывода аудио NVDA. Общий диалог применяет язык, голос, вариант, скорость, высоту тона и громкость, где выбранный синтезатор предоставляет эти настройки. Синтезаторы, которые полностью кодируют язык в выборе голоса, не показывают отдельный выбор языка.

Сводка рендеринга

После рендеринга soundWave сообщает синтезатор, сохранённый путь, затраченное время, длительность аудио и коэффициент скорости в реальном времени, когда это доступно.

Обновления

soundWave использует канал обновления дополнений NVDA для обновлений, совместимых с магазином.

Изменения

1.2.6

1.2.5

1.2.4

1.2.3

1.2.2

1.2.1

1.2.0

1.1.2

1.1.1

1.1.0

1.0.4

1.0.3

1.0.2

1.0.1

1.0.0

Устранение неполадок