Usługa syntezy mowy

Kolejka elektroniczna QOne oferuje własną usługę syntezy mowy do wdrożenia asystenta głosowego w uzupełnieniu do systemów automatyzacji przepływów klientów. Nasze rozwiązanie to wysokoefektywna usługa buforowania z możliwością automatycznego uzupełniania bazy wiadomości poprzez zewnętrzne usługi syntezy mowy (Google Text-to-Speech lub Responsive Voice)

Zalety usługi syntezy mowy

  • Niski koszt generowania nowych plików. Na przykład, dla bazy plików dźwiękowych opartych na Google Text-to-Speech cena wynosi 16 USD za 1 mln znaków
  • Obniżenie kosztów posiadania usługi poprzez segmentację wiadomości. Każdy unikalny segment jest odczytywany tylko raz
  • Własne algorytmy normalizacji wiadomości, które pozwalają jeszcze bardziej ograniczyć korzystanie z zewnętrznych usług

Google Text-to-Speech

  • Obsługa 120+ języków i odmian językowych
  • Precyzyjne wymawianie, formatowanie fraz w zależności od sytuacji językowej (np. daty, numery telefonów)
  • Wysoki poziom imitacji mowy, zbliżony do rzeczywistego życia
  • Wsparcie języka znaczników syntezy mowy (Speech Synthesis Markup Language) opartego na XML

Responsywne Głos

  • Usługa analizy dźwięku od firmy Responsive Voice
  • Wsparcie dla 42 języków
  • Konwersja tekstu na mowę na podstawie ukrytych modeli Markova
  • Intonacja jest określana przez sieć neuronową, nauczona na wielu przykładach z życia codziennego

Usługa oparta na wcześniej nagranych tekstach

W razie potrzeby nasza elektroniczna kolejka może korzystać z usługi opartej na wcześniej nagranych tekstach

Takie podejście znajduje zastosowanie w firmach, które posiadają w pełni zamknięte kontury. Aktualne dla banków i innych organizacji o wysokich wymaganiach dotyczących bezpieczeństwa

Usługa używana w systemie Elektronicznej Kolejki QOne oferuje prosty i potężny interfejs API, który pozwala otrzymywać sformułowane na podstawie zewnętrznej platformy głosowej komunikaty mp3 

Komunikaty głosowe są przekazywane w czasie rzeczywistym lub tworzone jako wcześniej utworzony bufor z plików dźwiękowych. Bufor jest tworzony na podstawie własnych algorytmów i wewnętrznej bazy usługi

Nowoczesne usługi głosowe na stosunkowo wysokim poziomie rozwiązują kwestie imitacji mowy zbliżonej do naturalnej - problemy z odtwarzaniem barwy głosu, płynności dźwięku i intonacji zostały wyeliminowane. Nasze rozwiązanie wykorzystuje wszystkie zalety nowoczesnych technologii rozpoznawania i syntezowania mowy od największych światowych deweloperów

Wyślij zgłoszenie

Zostaw zgłoszenie w formie opinii zwrotnej, a nasi specjaliści skontaktują się z Tobą