soundWave
soundWave je doplnok pre NVDA, ktorý renderuje text do zvukového súboru pomocou nainštalovaných rečových enginov.
Dokáže exportovať zvuk z textu v schránke, z textového súboru, z priečinka textových súborov alebo z textu zadaného priamo v doplnku.
Rýchly začiatok
- Stlačte NVDA+Ctrl+=, aby ste otvorili soundWave.
- Vyberte syntetizér.
- Voliteľne nastavte základný priečinok nahrávok. Je to predvolený priečinok na ukladanie renderov; soundWave v ňom vytvára výstupné priečinky podľa vašich šablón pomenovania.
- Vyberte zdroj vstupu: schránku, textový súbor, priečinok textových súborov alebo ručne zadaný či prilepený text.
- Nakonfigurujte syntetizér. Tlačidlom Testovať si vypočujte krátku ukážku aktuálnych nastavení.
- Vyberte názov výstupného súboru a formát.
- Počkajte na dokončenie renderovania a potom si pozrite súhrn.
V dialógoch renderovania soundWave stlačte F1, aby ste otvorili túto príručku.
V paneli soundWave v nastaveniach NVDA prejdite klávesom Tab na tlačidlo Pomocník alebo použite skratku Alt+H.
Ovládacie prvky dialógov majú klávesové skratky tam, kde je to praktické, napríklad Alt+T pre tlačidlo Testovať.
Vstup a výstup
- Vstup: text zo schránky, textový súbor, priečinok textových súborov alebo ručne zadaný či prilepený text.
- Výstup: WAV je podporovaný vždy. MP3, FLAC a M4A sú dostupné, keď je ffmpeg nainštalovaný a dostupný v systémovej premennej PATH.
- Dávkový vstup: výber priečinka vyrenderuje každý čitateľný textový súbor ako samostatný zvukový súbor v zoradenom poradí. Dávkové renderovanie sa predvolene ukladá do podpriečinka syntetizéra a hlasu a názvy súborov dostanú poradové čísla.
- Dlhé vstupy: dlhý text sa renderuje po častiach. Ak by jeden súbor WAV bol príliš veľký, soundWave zapíše očíslované časti.
- Priečinky a názvy súborov: soundWave môže samostatne pomenovať priečinky jedného renderovania, jednotlivé súbory, dávkové priečinky a dávkové súbory.
- Názvy hlasov: keď soundWave dokáže rozpoznať vybraný hlas, môže ho zahrnúť do šablón priečinkov alebo súborov, aby sa rendery toho istého vstupu s rôznymi syntetizérmi alebo hlasmi dali ľahšie rozlíšiť.
Priebeh renderovania
Počas renderovania soundWave zobrazuje dialóg priebehu s tlačidlom Zrušiť a voliteľnými podrobnosťami po riadkoch.
Tlačidlom Zobraziť podrobnosti môžete skontrolovať aktuálny súbor, časť textu, uplynulý čas, dĺžku vyrenderovaného zvuku a rýchlosť konverzie, ak sú tieto údaje dostupné.
Dlhé trvania sa zobrazujú v minútach alebo hodinách, nie iba ako počet sekúnd.
Pri dlhých renderoch použite tlačidlo Minimalizovať alebo skratku Alt+M, aby ste skryli dialóg priebehu.
Renderovanie pokračuje na pozadí a skrytý dialóg nezostáva v zozname Alt+Tab.
Opätovným stlačením príkazu soundWave, NVDA+Ctrl+=, vrátite aktívny dialóg priebehu.
Nastavenia
Otvorte nastavenia NVDA a vyberte kategóriu soundWave, aby ste nastavili predvoľby pre budúce rendery.
- Predvolený priečinok uloženia: základný priečinok nahrávok používaný v prvom dialógu soundWave. Ak ho ponecháte prázdny, použije sa Dokumenty\SoundWave, takže vyrenderované súbory zostanú na mieste, ktoré väčšina používateľov ľahko nájde.
- Pomenovanie priečinkov a súborov: samostatné šablóny riadia priečinky jedného renderovania, jednotlivé súbory, dávkové priečinky a dávkové súbory. Tabuľky nižšie ukazujú predvolené hodnoty, značky a príklady.
- Predvolený výstupný formát: vyberte WAV alebo MP3, FLAC či M4A, keď je dostupný ffmpeg. Voliteľné začiarkavacie políčka umožňujú preskočiť dialóg Uložiť ako pre jedno renderovanie a výber formátu pre dávku.
- Po renderovaní: vyberte, či má soundWave po dokončení celého renderovania otvoriť výstupný priečinok, otvoriť zvuk v predvolenom prehrávači médií alebo zobraziť súhrn renderovania. Automatické prehratie dávky otvorí vyrenderované súbory ako zoznam prehrávania. Automatické otvorenie priečinka znovu neotvorí priečinok, ktorý už soundWave otvoril v aktuálnej relácii NVDA.
Šablóny názvov
Polia názvov sú šablóny. soundWave pred navrhnutím priečinka alebo názvu súboru nahradí každú značku informáciami z aktuálneho renderovania.
Značky môžete odstrániť, presunúť, pridať vlastné slová alebo zmeniť interpunkciu medzi nimi.
| Nastavenie | Predvolené | Príklad výstupu | Čo ovláda |
| Vzor priečinka jedného renderovania |
%engine% - %voice% |
Sonata - Kirsten Two En Medium |
Priečinok ponúknutý dialógom Uložiť ako pre schránku, ručne zadaný text alebo jeden textový súbor. |
| Vzor názvu jedného súboru |
%source% |
Schránka.wav |
Navrhovaný názov súboru pre jedno renderovanie. |
| Vzor dávkového priečinka |
%engine% - %voice% |
Keynote Gold - Fred |
Výstupný priečinok vytvorený pri renderovaní priečinka textových súborov. |
| Vzor dávkového súboru |
%number% - %source% |
03 - tretia kapitola.wav |
Názov každého vyrenderovaného súboru v dávke. |
Príklady pomenovania
| Vzor | Príklad výstupu | Kedy je užitočný |
%engine% - %voice% |
Orpheus - Synthetic Dave |
Zoskupuje výstup podľa syntetizéra a hlasu. |
%source% - %engine% |
prvá kapitola - SAPI5.wav |
Ponechá zdroj na začiatku, ale stále označí syntetizér. |
%number% - %source% |
01 - úvodné titulky.wav |
Udržiava výstup dávky v predvídateľnom poradí. |
Význam značiek názvu súboru
| Značka | Význam | Príklad hodnoty |
%source% |
Schránka, zadaný text, názov zdrojového súboru alebo názov položky zo zdrojového priečinka. |
Schránka, Zadaný text, prvá kapitola alebo poznámky zo stretnutia |
%engine% |
Názov syntetizéra. |
Orpheus, Sonata, SAPI5 alebo Pocket TTS |
%voice% |
Vybraný hlas, keď ho soundWave dokáže rozpoznať. Ak hlas nie je známy, táto časť sa čisto odstráni. |
Synthetic Dave, Kirsten Two En Medium alebo Fred |
%number% |
Poradové číslo. Renderovanie priečinka ho pridáva automaticky; značka je dostupná aj pre vlastné vzory pomenovania. |
01, 02 alebo 03 |
Možnosti syntetizátorov
Syntetizátory sprístupňujú nastavenia ako hlas, jazyk, variant, rýchlosť, tempo, výška alebo hlasitosť tam, kde sú tieto možnosti dostupné.
Väčšina dialógov nastavení obsahuje:
- Automaticky prehrať pri zmene nastavení na automatický náhľad zmien.
- Testovať na prehratie krátkej ukážky s aktuálnymi nastaveniami.
- Trvalé nastavenia uložené v konfigurácii NVDA.
Podporované syntetizátory
| Syntetizér | Poznámky |
| SAPI5 |
Používa nainštalované hlasy Microsoft SAPI5. 32-bitové hlasy SAPI5 sú podporované samostatnou 32-bitovou pomocnou cestou, keď je dostupná. V dialógu renderovania možno nastaviť tempo, výšku a hlasitosť SAPI5. soundWave sa pýta SAPI na predvolený výstupný formát vybraného hlasu namiesto vynucovania pevnej vzorkovacej frekvencie; ak SAPI formát neposkytne, použije sa záložný formát 22,05 kHz 16-bit mono. |
| googleTtsForNvda |
Vyžaduje doplnok Google TTS For NVDA a nainštalované balíky hlasov Google. soundWave pri renderovaní priamo zachytáva PCM zvuk generovaný doplnkom. Tlačidlo Testovať vyrenderuje krátku ukážku do dočasného WAV súboru a prehrá ju, takže nepoužíva živú reč NVDA. soundWave zobrazuje iba hlasy Google, ktoré sú nainštalované a spoľahlivé v tejto offline renderovacej ceste, takže zoznam môže byť kratší ako úplný katalóg hlasov doplnku Google. |
| Pocket TTS |
Vyžaduje doplnok Pocket TTS. soundWave podľa potreby renderuje v menších segmentoch, aby dlhší text menej často narazil na limity modelu. Dialóg možností obsahuje citlivosť konca vety Pocket TTS, ak ju nainštalovaný syntetizér sprístupňuje. |
| Supertonic |
Vyžaduje doplnok Supertonic. soundWave používa pre Supertonic menšie časti renderovania, aby sa dlhší vstup dal vyrenderovať bez prekročenia limitu veľkosti vstupu modelu. |
| Sonata |
Vyžaduje doplnok Sonata Neural Voices a dostupné konfiguračné súbory hlasov. |
| Eloquence a IBMTTS |
Dostupné, keď je nainštalovaný príslušný doplnok NVDA. soundWave automaticky zistí rečový engine a pred renderovaním ponúkne možnosti hlasu a rýchlosti. |
| Orpheus |
Vyžaduje, aby bol Orpheus aktuálnym syntetizérom NVDA pred začatím renderovania. Pred renderovaním možno nastaviť jazyk, hlas, rýchlosť, výšku a hlasitosť. Počas renderovania soundWave dočasne prepne NVDA na dostupný záložný syntetizér. |
| Orpheus Classic |
Dostupný, keď je nainštalovaný doplnok Orpheus Classic. soundWave používa pre tento starší syntetizér vyhradenú zachytávaciu cestu, aby dlhšie pauzy a interpunkcia nespôsobovali skrátený výstup. |
| DECtalk a Keynote Gold |
Dostupné, keď je požadovaný doplnok nainštalovaný a zistiteľný. Keynote Gold v dialógu renderovania sprístupňuje hlas, rýchlosť, výšku, hlasitosť a zrýchlenie tempa. |
| Iné syntetizátory NVDA |
soundWave dokáže renderovať mnoho ďalších nainštalovaných syntetizátorov NVDA, keď používajú bežnú zvukovú výstupnú cestu NVDA. Všeobecný dialóg použije hlas, variant, tempo, výšku a hlasitosť tam, kde ich vybraný syntetizér sprístupňuje. |
Súhrn renderovania
Po renderovaní soundWave oznámi syntetizér, uloženú cestu, uplynulý čas, dĺžku zvuku a faktor rýchlosti voči reálnemu času, ak je dostupný.
Aktualizácie
soundWave používa aktualizačný kanál doplnkov NVDA kompatibilný s distribúciou cez Add-on Store.
Zmeny
1.1.2
- Pridaná vyhradená cesta zachytávania Orpheus Classic. soundWave teraz renderuje Orpheus Classic cez bežný tok ovládača NVDA a priamo zachytáva generovaný zvuk, čím sa predchádza veľmi krátkemu výstupu, ktorý sa mohol objaviť pri všeobecnom zachytávaní NVDA.
- Vylepšené renderovanie Orpheus Classic pri väčších interpunkčných pauzách vrátane riadkov s výkričníkmi a dlhších páuz v príspevkoch podobných Mastodonu.
1.1.1
- Vylepšené dlhé rendery googleTtsForNvda opätovným použitím jednej inštancie mosta Google počas celého renderovania, menšími časťami špecifickými pre Google a opakovaním obnoviteľných zlyhaní mosta Chrome DevTools.
- Zmenený dialóg priebehu tak, aby sa dal minimalizovať skratkou Alt+M. Opätovné stlačenie príkazu soundWave obnoví aktívny priebeh namiesto otvorenia druhého renderovacieho dialógu.
- Vylepšené hlásenie uplynulého času a dĺžky zvuku, aby sa dlhé rendery zobrazovali v minútach alebo hodinách, nie iba v sekundách.
- Po zachytávaní všeobecných syntetizátorov NVDA sa obnovujú nastavenia hlasu, variantu, jazyka, tempa, výšky a hlasitosti, aby sa znížilo riziko prenesenia nastavení späť do bežiacej reči NVDA.
- Zatvára #5.
1.1.0
- Výrazne vylepšená podpora googleTtsForNvda. SoundWave renderuje cez most Google spoľahlivejšie, zobrazuje iba nainštalované hlasy fungujúce cez offline renderovaciu cestu, skúsi to znova, ak stránka mosta nie je pripravená, a neprepína potichu na iný hlas.
- Vylepšené ukážky googleTtsForNvda renderovaním testovacej frázy do dočasného WAV súboru pred prehratím, takže automatický náhľad môže zostať zapnutý bez použitia živej reči NVDA.
- Vylepšený text priebehu renderovania googleTtsForNvda počas čakania na zvuk od Google.
- Vylepšené renderovanie Pocket TTS preskočením prázdnych riadkov a rozdelením textu na bezpečnejšie segmenty pre model.
- Pridaná citlivosť konca vety Pocket TTS do dialógu možností syntetizátora, keď je dostupná.
- Pridané delenie špecifické pre Supertonic, aby sa dlhší vstup dal renderovať bez prekročenia limitu veľkosti vstupu modelu.
- Pridaný výstup FLAC a M4A, keď je ffmpeg nainštalovaný a dostupný v systémovej premennej PATH.
- Zmenený výber výstupného formátu tak, aby si jedno aj dávkové renderovanie pamätalo posledný vybraný formát.
- Pridané voliteľné nastavenia na použitie predvoleného výstupného formátu bez zobrazenia dialógu Uložiť ako pri jednom renderovaní alebo výberu dávkového formátu.
- Zmenené automatické prehratie dávky tak, aby dokončené renderovanie priečinka otvorilo zoznam prehrávania namiesto prehratia iba prvého súboru.
- Zmenené automatické otváranie výstupného priečinka tak, aby soundWave neotváral rovnaký priečinok opakovane v jednej relácii NVDA.
- Pridaný panel nastavení soundWave v nastaveniach NVDA pre predvolený priečinok uloženia, šablóny pomenovania a akcie po renderovaní.
- Pridané akcie po renderovaní na otvorenie výstupného priečinka, prehratie dokončeného zvukového súboru a ovládanie zobrazenia súhrnu renderovania.
- Pridané tlačidlo Otvoriť priečinok do súhrnu dokončeného renderovania.
- Pridaný vstup priečinka pre dávkové renderovanie.
- Vylepšené pomenovanie výstupu samostatnými šablónami pre priečinky jedného renderovania, jednotlivé súbory, dávkové priečinky a dávkové súbory.
- Vylepšené navrhované názvy výstupných súborov tak, aby sa vybrané názvy hlasov zahrnuli do viacerých renderovacích ciest.
- Špecializovaná podpora syntetizátorov bola rozdelená do samostatných modulov pre SAPI5, DECtalk, BestSpeech, Sonata, Pocket TTS, googleTtsForNvda, Eloquence/IBMTTS, Orpheus a všeobecné zachytávacie cesty NVDA.
- Pridané automatické zisťovanie Eloquence a IBMTTS, aby renderovali cez vyhradenú cestu enginu namiesto všeobecného zachytávania NVDA.
1.0.4
- Pridaná podpora renderovania googleTtsForNvda na základe PR #3 od Ruslana Dolovaniuka.
1.0.3
- Pridaná podpora výšky SAPI5 pomocou natívnej XML značky pitch v SAPI.
- Zmenené renderovanie WAV pre SAPI5 tak, aby používalo predvolený výstupný formát vybraného hlasu SAPI, keď je dostupný, namiesto pevného vynútenia 22,05 kHz 16-bit mono.
1.0.2
- Pridané ovládanie výšky a hlasitosti pre Orpheus, Keynote Gold a všeobecné renderovanie syntetizátorov NVDA.
- Pridaná podpora hlasitosti pre renderovanie SAPI5.
- Vylepšené klávesové nastavovanie číselných možností. Page Up a Page Down teraz robia väčšie zmeny a Home a End skočia na minimálnu alebo maximálnu hodnotu.
- Podrobnosti renderovania boli zmenené na zoznam po riadkoch, aby sa informácie o priebehu dali ľahšie kontrolovať čítačom obrazovky.
- Zapamätá sa, či sú podrobnosti renderovania zobrazené alebo skryté medzi rendermi.
- Pridané názvy vybraných hlasov do navrhovaných výstupných názvov, keď SoundWave dokáže hlas rozpoznať.
- Pridaný prístup k príručke klávesom F1 v renderovacích dialógoch soundWave a tlačidlá Pomocník dostupné klávesom Tab.
- Vylepšené klávesové skratky dialógov vrátane tlačidiel Testovať a ovládacích prvkov možností syntetizátora.
1.0.1
- Zladená podpora aktualizácií s distribúciou cez NVDA Add-on Store.
1.0.0
Riešenie problémov
- Nevytvorí sa žiadny zvuk: vybraný syntetizér nemusí sprístupňovať zvukovú cestu, ktorú soundWave dokáže renderovať. Skúste iný syntetizér a skontrolujte log NVDA.
- Eloquence alebo IBMTTS nie je dostupný: nainštalujte alebo aktualizujte príslušný doplnok NVDA, znovu načítajte NVDA a skúste to znova.
- Orpheus sa nespustí: prepnite aktuálny syntetizér NVDA na Orpheus a potom znova otvorte soundWave.
- WorldVoice sa neinicializuje: skontrolujte log NVDA, či nechýbajú súbory pod WorldVoice-workspace. soundWave nemôže renderovať WorldVoice, kým sa samotný WorldVoice nenačíta správne.
- Export MP3, FLAC alebo M4A zlyhá: nainštalujte ffmpeg a uistite sa, že príkaz ffmpeg funguje z príkazového riadka.
- Renderovanie vyzerá zaseknuté: použite Zrušiť. Ak sa problém opakuje, do hlásenia uveďte názov syntetizéra, nastavenia, typ vstupu a príslušné záznamy z logu NVDA.