Servizio di sintesi vocale

La coda elettronica QOne offre un servizio di sintesi vocale per implementare un assistente vocale in aggiunta ai sistemi di automazione dei flussi clienti. La nostra soluzione è un servizio di cache altamente efficiente con la possibilità di ricaricare automaticamente la base dei messaggi tramite servizi esterni di sintesi vocale (Google Text-to-Speech o Responsive Voice)

Vantaggi del servizio di sintesi vocale

  • Basso costo di generazione di nuovi file. Ad esempio, per una base di file audio basata su Google Text-to-Speech, il prezzo è di 16 USD per 1 milione di caratteri
  • Riduzione del costo di possesso del servizio grazie alla segmentazione dei messaggi. Ogni segmento unico viene letto solo una volta
  • Algoritmi proprietari di normalizzazione dei messaggi che consentono di ridurre ulteriormente le chiamate ai servizi esterni

Google Text-to-Speech

  • Supporto per oltre 120 lingue e varianti linguistiche
  • Pronuncia precisa, formattazione delle frasi in base alla situazione linguistica (ad esempio, date, numeri di telefono)
  • Alto livello di imitazione del linguaggio parlato, vicino alla vita reale
  • Supporto al Linguaggio di Markup della Sintesi Vocale (Speech Synthesis Markup Language) basato su XML

Voce Responsiva

  • Servizio di Analisi Vocale da parte di Responsive Voice
  • Supporto per 42 lingue
  • Conversione del testo in voce basata su modelli nascosti di Markov
  • L'intonazione è determinata da una rete neurale addestrata su molti esempi della vita reale

Servizio basato su testi pre-registrati

Se necessario, la nostra coda elettronica può utilizzare un servizio basato su testi pre-registrati.

Questo approccio trova applicazione in aziende con contorni completamente chiusi. Rilevante per banche e altre organizzazioni con elevate esigenze di sicurezza.

Il servizio utilizzato nel sistema di coda elettronica QOne presenta un API semplice e potente che consente di ricevere messaggi vocali mp3 generati sulla base di una piattaforma vocale di terze parti. 

I messaggi vocali vengono trasmessi in tempo reale o vengono generati come una cache pre-creata da file audio. La cache è costruita sui propri algoritmi e sulla base interna del servizio.

I servizi vocali moderni affrontano a un livello relativamente alto la questione dell'imitazione della pronuncia simile a quella naturale - sono risolti i problemi di ricreazione del timbro vocale, della fluidità del suono e dell'intonazione. La soluzione che abbiamo creato sfrutta tutti i vantaggi delle moderne tecnologie di riconoscimento e sintesi vocale dei principali sviluppatori mondiali.

Invia una richiesta

Lascia una richiesta nel formato del feedback e i nostri specialisti ti contatteranno