Sprachsynthese-Service

Die elektronische Warteschlange QOne bietet einen eigenen Sprachsynthese-Service zur Implementierung eines Sprachassistenten in Ergänzung zu den Systemen zur Automatisierung des Kundenverkehrs. Unsere Lösung ist ein hoch effizienter Caching-Service mit der Möglichkeit zur automatischen Aktualisierung der Nachrichtenbank über externe Sprachsynthese-Services (Google Text-to-Speech oder Responsive Voice).

Vorteile des Sprachsynthese-Services

  • Niedrige Kosten für die Generierung neuer Dateien. Zum Beispiel beträgt der Preis für die Erstellung einer Audiobasisdatei auf der Grundlage von Google Text-to-Speech 16 USD pro 1 Mio. Zeichen
  • Senkung der Besitzkosten des Services durch Segmentierung der Nachrichten. Jedes einzigartige Segment wird nur einmal vertont
  • Eigene Algorithmen zur Normalisierung von Nachrichten, die es ermöglichen, die Abhängigkeit von externen Services weiter zu reduzieren

Google Text-to-Speech

  • Unterstützung von 120+ Sprachen und Sprachvarianten
  • Exakte Aussprache, Formatierung von Sätzen je nach sprachlicher Situation (z.B. Datum, Telefonnummern)
  • Hoher Grad an Sprachimitation, der der realen Sprache nahekommt
  • Unterstützung der Sprachsynthese-Markup-Sprache (Speech Synthesis Markup Language), die auf XML basiert

Responsive Voice

  • Audioanalyse-Service von Responsive Voice
  • Unterstützung von 42 Sprachen
  • Text-zu-Sprache-Umwandlung basierend auf Hidden Markov Models
  • Die Intonation wird von einem neuronalen Netzwerk festgelegt, das anhand vieler Beispiele aus dem wirklichen Leben trainiert wurde

Service basierend auf vorab aufgezeichneten Texten

Bei Bedarf kann unsere elektronische Warteschlange den Service basierend auf vorab aufgezeichneten Texten nutzen.

Dieser Ansatz findet Anwendung in Unternehmen mit vollständig geschlossenen Schaltkreisen. Relevant für Banken und andere Organisationen mit hohen Sicherheitsanforderungen.

Der in QOne Electronic Queue System verwendete Service bietet eine einfache und leistungsstarke API, mit der auf Basis einer externen Sprachplattform erstellte mp3-Sprachnachrichten empfangen werden können. 

Die Sprachnachrichten werden in Echtzeit übertragen oder als vorab erstellter Cache aus Audiodateien erstellt. Der Cache wird basierend auf eigenen Algorithmen und der internen Basis des Dienstes erstellt.

Moderne Sprachdienste auf einem relativ hohen Niveau lösen das Problem der Imitation von naturnaher Aussprache - Probleme bei der Wiedergabe des Stimmklangs, der Klarheit des Klangs und der Intonation wurden beseitigt. Unsere Lösung nutzt alle Vorteile moderner Technologien zur Spracherkennung und -ausgabe von führenden Entwicklern weltweit.

Anfrage senden

Hinterlassen Sie eine Anfrage im Feedback-Format und unsere Spezialisten werden sich mit Ihnen in Verbindung setzen