La coda elettronica QOne offre un servizio di sintesi vocale per implementare un assistente vocale in aggiunta ai sistemi di automazione dei flussi clienti. La nostra soluzione è un servizio di cache altamente efficiente con la possibilità di ricaricare automaticamente la base dei messaggi tramite servizi esterni di sintesi vocale (Google Text-to-Speech o Responsive Voice)
Vantaggi del servizio di sintesi vocale
- Basso costo di generazione di nuovi file. Ad esempio, per una base di file audio basata su Google Text-to-Speech, il prezzo è di 16 USD per 1 milione di caratteri
- Riduzione del costo di possesso del servizio grazie alla segmentazione dei messaggi. Ogni segmento unico viene letto solo una volta
- Algoritmi proprietari di normalizzazione dei messaggi che consentono di ridurre ulteriormente le chiamate ai servizi esterni
Google Text-to-Speech
- Supporto per oltre 120 lingue e varianti linguistiche
- Pronuncia precisa, formattazione delle frasi in base alla situazione linguistica (ad esempio, date, numeri di telefono)
- Alto livello di imitazione del linguaggio parlato, vicino alla vita reale
- Supporto al Linguaggio di Markup della Sintesi Vocale (Speech Synthesis Markup Language) basato su XML
Voce Responsiva
- Servizio di Analisi Vocale da parte di Responsive Voice
- Supporto per 42 lingue
- Conversione del testo in voce basata su modelli nascosti di Markov
- L'intonazione è determinata da una rete neurale addestrata su molti esempi della vita reale
Servizio basato su testi pre-registrati
Se necessario, la nostra coda elettronica può utilizzare un servizio basato su testi pre-registrati.
Questo approccio trova applicazione in aziende con contorni completamente chiusi. Rilevante per banche e altre organizzazioni con elevate esigenze di sicurezza.
Il servizio utilizzato nel sistema di coda elettronica QOne presenta un API semplice e potente che consente di ricevere messaggi vocali mp3 generati sulla base di una piattaforma vocale di terze parti.
I messaggi vocali vengono trasmessi in tempo reale o vengono generati come una cache pre-creata da file audio. La cache è costruita sui propri algoritmi e sulla base interna del servizio.
I servizi vocali moderni affrontano a un livello relativamente alto la questione dell'imitazione della pronuncia simile a quella naturale - sono risolti i problemi di ricreazione del timbro vocale, della fluidità del suono e dell'intonazione. La soluzione che abbiamo creato sfrutta tutti i vantaggi delle moderne tecnologie di riconoscimento e sintesi vocale dei principali sviluppatori mondiali.