QOne Electronic Queue ofrece su propio servicio de síntesis de voz para implementar un asistente de voz además de sistemas de automatización del flujo de clientes. Nuestra solución es un servicio de almacenamiento en caché altamente eficiente con la capacidad de reponer automáticamente la base de datos de mensajes a través de servicios externos de síntesis de voz (Google Text-to-Speech o Responsive Voice).
Ventajas de un servicio de síntesis de voz
- Bajo costo de generación de nuevos archivos. Por ejemplo, para una base de datos de archivos de audio basada en Google Text-to-Speech, el precio es de 16 USD por 1 millón de caracteres.
- Reducir el coste de propiedad del servicio mediante la segmentación de mensajes. Cada segmento único se expresa solo una vez.
- Algoritmos propietarios de normalización de mensajes, que pueden reducir aún más las llamadas a servicios externos.
Texto a voz de Google
- Admite más de 120 idiomas y variedades de idiomas
- Pronunciación precisa, formato de frases según la situación del idioma (por ejemplo, fechas, números de teléfono)
- Alto nivel de imitación del habla, cercano a la vida real.
- Soporte para Language Markup de síntesis de voz (Speech Synthesis Markup Language) basado en XML
Voz receptiva
- Servicio de análisis de voz de Responsive Voice
- Soporte para 42 idiomas
- Conversión de texto a voz basada en modelos ocultos de Markov
- La entonación se establece con una red neuronal entrenada en muchos ejemplos de la vida real
Servicio basado en textos pregrabados
Si es necesario, nuestra cola electrónica puede utilizar un servicio basado en textos pregrabados.
Este enfoque se utiliza en empresas con contornos completamente cerrados. Relevante para bancos y otras organizaciones con altos requisitos de seguridad.
El servicio utilizado en el sistema de cola electrónica QOne proporciona una API simple y potente que permite recibir mensajes de voz mp3 generados en base a una plataforma de voz de terceros.
Los mensajes de voz se transmiten en tiempo real o se generan como una caché previamente creada a partir de archivos de sonido. La caché se construye sobre la base de algoritmos propios y la base interna del servicio.
Los servicios de voz modernos resuelven a un nivel comparativamente alto el problema de imitar la pronunciación cercana a la natural, se han eliminado los problemas de recrear el timbre de voz, la suavidad del sonido y la entonación. Nuestra solución aprovecha todas las ventajas de las tecnologías modernas de reconocimiento y vocalización de los principales desarrolladores mundiales.