Kolejka elektroniczna QOne oferuje własną usługę syntezy mowy do wdrożenia asystenta głosowego w uzupełnieniu do systemów automatyzacji przepływów klientów. Nasze rozwiązanie to wysokoefektywna usługa buforowania z możliwością automatycznego uzupełniania bazy wiadomości poprzez zewnętrzne usługi syntezy mowy (Google Text-to-Speech lub Responsive Voice)
Zalety usługi syntezy mowy
- Niski koszt generowania nowych plików. Na przykład, dla bazy plików dźwiękowych opartych na Google Text-to-Speech cena wynosi 16 USD za 1 mln znaków
- Obniżenie kosztów posiadania usługi poprzez segmentację wiadomości. Każdy unikalny segment jest odczytywany tylko raz
- Własne algorytmy normalizacji wiadomości, które pozwalają jeszcze bardziej ograniczyć korzystanie z zewnętrznych usług
Google Text-to-Speech
- Obsługa 120+ języków i odmian językowych
- Precyzyjne wymawianie, formatowanie fraz w zależności od sytuacji językowej (np. daty, numery telefonów)
- Wysoki poziom imitacji mowy, zbliżony do rzeczywistego życia
- Wsparcie języka znaczników syntezy mowy (Speech Synthesis Markup Language) opartego na XML
Responsywne Głos
- Usługa analizy dźwięku od firmy Responsive Voice
- Wsparcie dla 42 języków
- Konwersja tekstu na mowę na podstawie ukrytych modeli Markova
- Intonacja jest określana przez sieć neuronową, nauczona na wielu przykładach z życia codziennego
Usługa oparta na wcześniej nagranych tekstach
W razie potrzeby nasza elektroniczna kolejka może korzystać z usługi opartej na wcześniej nagranych tekstach
Takie podejście znajduje zastosowanie w firmach, które posiadają w pełni zamknięte kontury. Aktualne dla banków i innych organizacji o wysokich wymaganiach dotyczących bezpieczeństwa
Usługa używana w systemie Elektronicznej Kolejki QOne oferuje prosty i potężny interfejs API, który pozwala otrzymywać sformułowane na podstawie zewnętrznej platformy głosowej komunikaty mp3
Komunikaty głosowe są przekazywane w czasie rzeczywistym lub tworzone jako wcześniej utworzony bufor z plików dźwiękowych. Bufor jest tworzony na podstawie własnych algorytmów i wewnętrznej bazy usługi
Nowoczesne usługi głosowe na stosunkowo wysokim poziomie rozwiązują kwestie imitacji mowy zbliżonej do naturalnej - problemy z odtwarzaniem barwy głosu, płynności dźwięku i intonacji zostały wyeliminowane. Nasze rozwiązanie wykorzystuje wszystkie zalety nowoczesnych technologii rozpoznawania i syntezowania mowy od największych światowych deweloperów