Tryb dialogu: każdą kwestię poprzedź tagiem z nazwą głosu, np. [Ola] / [Adam] (dowolny głos z listy). [Ola] Dzień dobry, w czym mogę pomóc? [Adam] Chciałbym zgłosić awarię.
Gotowy.
Głosy — odsłuch
Każdy głos czyta ten sam tekst, więc barwy da się porównywać wprost.
Odtwarzacz pobiera dźwięk dopiero po kliknięciu — pierwsze uruchomienie
nieprzesłuchanego jeszcze głosu może potrwać kilka sekund.
Brak głosów na serwerze.
Kalibracja strażnika — pomiar głosów
Strażnik końcówki ma dla każdego głosu próg, na którym rozstrzyga, czy wypowiedź
została ucięta i trzeba ją wygenerować od nowa. Zły próg psuje na dwa RÓŻNE sposoby,
dlatego stoją tu dwie osobne kolumny: ucięte końcówki to wady, które przeszły
do klienta, a koszt regeneracji to ruch spalony na powtórki wypowiedzi, które
były w porządku. Jedna wspólna liczba ukryłaby dokładnie tę różnicę.
Głos
Ucięte końcówki
Koszt regeneracji
Próg
Tempo
Akcje
Uwagi o wzorcu
Ładowanie…
Nowy głos
Utwórz głos z opisu (bez próbki)
Opisz głos po angielsku (płeć/wiek/rola, barwa, emocja).
Wygeneruj podgląd, przelosuj aż będzie dobry, potem zapisz.
Sklonowane głosy
Ładowanie…
Warstwy przetwarzania tekstu
Kolejno: usunięcie nawiasów → podział na zdania → leksykon →
normalizacja. Wyłączona warstwa jest po prostu pomijana —
zobaczysz to w „Podglądzie tekstu" na zakładce Synteza.
Leksykon zamian tekstu
Reguły zamieniają fragmenty tekstu przed syntezą — przydatne do rozwijania skrótów
(np. np. → na przykład, ul. → ulica) lub poprawiania wymowy.
Zamiany działają we wszystkich trybach. Zmiany zapisują się po kliknięciu „Zapisz leksykon”
(wymaga hasła administratora).
Skrót / tekst źródłowy
Zamiana
Całe słowo
Ignoruj wielkość
Aktywna
Przenieś głos z innej maszyny
Paczka ZIP z wzorcem, transkrypcją i kalibracją. Pobierzesz ją przyciskiem
„Eksportuj” przy głosie na maszynie źródłowej (zakładka „Generowanie głosu”).