soundWave

soundWave to dodatek do NVDA, który renderuje tekst do pliku audio przy użyciu zainstalowanych silników mowy. Może eksportować dźwięk z tekstu znajdującego się w schowku, z pliku tekstowego, z folderu plików tekstowych albo z tekstu wpisanego bezpośrednio w dodatku.

Szybki start

  1. Naciśnij NVDA+Ctrl+=, aby otworzyć soundWave.
  2. Wybierz syntezator.
  3. Opcjonalnie ustaw bazowy folder nagrań. Jest to domyślny folder zapisu renderów; soundWave tworzy w nim foldery wyjściowe według szablonów nazewnictwa.
  4. Wybierz źródło tekstu: schowek, plik tekstowy, folder plików tekstowych albo tekst wpisany lub wklejony ręcznie.
  5. Skonfiguruj syntezator. Użyj przycisku Test, aby odsłuchać krótki podgląd wybranych ustawień.
  6. Wybierz nazwę pliku wyjściowego i format.
  7. Poczekaj na zakończenie renderowania, a następnie sprawdź podsumowanie.

W oknach renderowania soundWave naciśnij F1, aby otworzyć tę instrukcję. W panelu soundWave w ustawieniach NVDA przejdź klawiszem Tab do przycisku Pomoc albo użyj skrótu Alt+H. Kontrolki dialogów mają skróty klawiaturowe tam, gdzie jest to praktyczne, na przykład Alt+T dla przycisku Test.

Wejście i wyjście

Postęp renderowania

Podczas renderowania soundWave pokazuje okno postępu z przyciskiem Anuluj oraz opcjonalnymi szczegółami wiersz po wierszu. Użyj przycisku Pokaż szczegóły, aby sprawdzić bieżący plik, fragment tekstu, czas działania, długość wyrenderowanego audio i współczynnik szybkości, jeśli te informacje są dostępne. Długie czasy są pokazywane jako minuty albo godziny, a nie tylko jako liczba sekund.

Przy długich renderach użyj przycisku Minimalizuj albo skrótu Alt+M, aby ukryć okno postępu. Renderowanie będzie działać w tle, a ukryte okno nie będzie przeszkadzać na liście Alt+Tab. Naciśnij ponownie polecenie soundWave, NVDA+Ctrl+=, aby przywrócić aktywne okno postępu.

Ustawienia

Otwórz ustawienia NVDA i wybierz kategorię soundWave, aby ustawić domyślne opcje używane przez kolejne rendery.

Szablony nazw

Pola nazw są szablonami. soundWave zastępuje każdy znacznik informacjami z bieżącego renderowania przed zaproponowaniem folderu lub nazwy pliku. Możesz usuwać znaczniki, przenosić je, dodawać własne słowa albo zmieniać interpunkcję między nimi.

UstawienieDomyślniePrzykładowy wynikCo kontroluje
Wzorzec folderu pojedynczego renderowania %engine% - %voice% Sonata - Kirsten Two En Medium Folder proponowany przez okno Zapisz jako dla schowka, wpisanego tekstu albo jednego pliku tekstowego.
Wzorzec nazwy pojedynczego pliku %source% Schowek.wav Sugerowana nazwa pliku dla pojedynczego renderowania.
Wzorzec folderu wsadowego %engine% - %voice% Keynote Gold - Fred Folder wyjściowy tworzony podczas renderowania folderu plików tekstowych.
Wzorzec pliku wsadowego %number% - %source% 03 - rozdział trzeci.wav Nazwa każdego wyrenderowanego pliku w trybie wsadowym.

Przykłady nazw

WzorzecPrzykładowy wynikKiedy jest przydatny
%engine% - %voice% Orpheus - Synthetic Dave Grupuje wyjście według syntezatora i głosu.
%source% - %engine% rozdział pierwszy - SAPI5.wav Zostawia nazwę źródła na początku, ale nadal pokazuje syntezator.
%number% - %source% 01 - napisy początkowe.wav Utrzymuje przewidywalną kolejność plików wsadowych.
Znaczenie znaczników nazw plików
ZnacznikZnaczeniePrzykładowa wartość
%source% Schowek, wpisany tekst, nazwa pliku źródłowego albo nazwa elementu z folderu źródłowego. Schowek, Wpisany tekst, rozdział pierwszy albo notatki ze spotkania
%engine% Nazwa syntezatora. Orpheus, Sonata, SAPI5 albo Pocket TTS
%voice% Wybrany głos, jeśli soundWave potrafi go rozpoznać. Jeśli głos nie jest znany, ta część jest usuwana w czysty sposób. Synthetic Dave, Kirsten Two En Medium albo Fred
%number% Numer porządkowy. Renderowanie folderu dodaje go automatycznie; znacznik jest dostępny także dla własnych wzorców nazw. 01, 02 albo 03

Opcje syntezatorów

Syntezatory udostępniają takie ustawienia jak głos, język, wariant, szybkość, tempo, wysokość albo głośność tam, gdzie dana opcja jest obsługiwana. Większość okien ustawień zawiera:

Obsługiwane syntezatory

SyntezatorUwagi
SAPI5 Używa zainstalowanych głosów Microsoft SAPI5. Głosy SAPI5 32-bit są obsługiwane osobną ścieżką pomocniczą 32-bit, jeśli jest dostępna. W oknie renderowania można regulować tempo, wysokość i głośność SAPI5. soundWave pyta SAPI o domyślny format wyjściowy wybranego głosu zamiast wymuszać stałą częstotliwość próbkowania; jeśli SAPI nie udostępnia formatu, używany jest zapasowy format 22,05 kHz 16-bit mono.
googleTtsForNvda Wymaga dodatku Google TTS For NVDA oraz zainstalowanych pakietów głosów Google. Podczas renderowania soundWave bezpośrednio przechwytuje audio PCM generowane przez dodatek. Przycisk Test renderuje krótką próbkę do tymczasowego pliku WAV i ją odtwarza, omijając ścieżkę bieżącej mowy NVDA. soundWave pokazuje tylko głosy Google zainstalowane i stabilne w tej ścieżce renderowania offline, więc lista może być krótsza niż pełny katalog głosów dodatku Google.
Pocket TTS Wymaga dodatku Pocket TTS. soundWave renderuje w mniejszych segmentach, gdy jest to potrzebne, aby dłuższy tekst rzadziej trafiał na ograniczenia modelu. Okno opcji zawiera czułość końca zdania Pocket TTS, jeśli zainstalowany syntezator ją udostępnia.
Supertonic Wymaga dodatku Supertonic. soundWave używa mniejszych fragmentów renderowania dla Supertonic, aby dłuższe wejście mogło zostać wyrenderowane bez przekroczenia limitu rozmiaru wejścia modelu.
Sonata Wymaga dodatku Sonata Neural Voices oraz dostępnych plików konfiguracji głosów.
Eloquence i IBMTTS Dostępne, gdy zainstalowany jest odpowiedni dodatek NVDA. soundWave automatycznie wykrywa silnik mowy i udostępnia opcje głosu oraz szybkości przed renderowaniem.
Orpheus Wymaga ustawienia Orpheus jako bieżącego syntezatora NVDA przed rozpoczęciem renderowania. Przed renderowaniem można regulować język, głos, szybkość, wysokość i głośność. Podczas renderowania soundWave tymczasowo przełącza NVDA na dostępny syntezator zapasowy.
Orpheus Classic Dostępny, gdy zainstalowany jest dodatek Orpheus Classic. soundWave używa dedykowanej ścieżki przechwytywania dla tego starszego syntezatora, dzięki czemu dłuższe pauzy i znaki interpunkcyjne nie powodują ucinania wyjścia.
DECtalk i Keynote Gold Dostępne, gdy wymagany dodatek jest zainstalowany i możliwy do wykrycia. Keynote Gold udostępnia w oknie renderowania głos, szybkość, wysokość, głośność i przyspieszenie tempa.
Inne syntezatory NVDA soundWave może renderować wiele innych zainstalowanych syntezatorów NVDA, jeśli używają normalnej ścieżki wyjścia audio NVDA. Ogólne okno opcji stosuje głos, wariant, tempo, wysokość i głośność tam, gdzie wybrany syntezator udostępnia te ustawienia.

Podsumowanie renderowania

Po renderowaniu soundWave zgłasza syntezator, ścieżkę zapisu, czas działania, długość audio i współczynnik szybkości względem czasu rzeczywistego, jeśli jest dostępny.

Aktualizacje

soundWave używa kanału aktualizacji dodatków NVDA zgodnego z dystrybucją przez Add-on Store.

Zmiany

1.1.2

1.1.1

1.1.0

1.0.4

1.0.3

1.0.2

1.0.1

1.0.0

Rozwiązywanie problemów