Serviço de síntese de voz

QOne Electronic Queue oferece seu próprio serviço de síntese de voz para implantar um assistente de voz, além de sistemas de automação de fluxo de clientes. Nossa solução é um serviço de cache altamente eficiente com a capacidade de reabastecer automaticamente o banco de dados de mensagens por meio de serviços externos de síntese de fala (Google Text-to-Speech ou Responsive Voice).

Vantagens de um serviço de síntese de voz

  • Baixo custo de geração de novos arquivos. Por exemplo, para um banco de dados de arquivos de áudio baseado no Google Text-to-Speech, o preço é de 16 USD por 1 milhão de caracteres
  • Reduzindo o custo de propriedade do serviço através da segmentação de mensagens. Cada segmento único é dublado apenas uma vez
  • Algoritmos proprietários de normalização de mensagens, que podem reduzir ainda mais as chamadas para serviços externos

Conversão de texto em fala do Google

  • Suporta mais de 120 idiomas e variedades de idiomas
  • Pronúncia precisa, formatação de frases dependendo da situação do idioma (por exemplo, datas, números de telefone)
  • Alto nível de imitação de fala, próximo da vida real
  • Suporte à Linguagem de Marcação de Síntese de Fala (Speech Synthesis Markup Language), baseada em XML

Voz Responsiva

  • Serviço de Análise de Voz da Responsive Voice
  • Suporte a 42 idiomas
  • Conversão de texto em fala baseada em modelos ocultos de Markov
  • A entonação é definida por uma rede neural treinada em muitos exemplos da vida real

Serviço baseado em textos pré-gravados

Se necessário, nossa fila eletrônica pode usar o serviço baseado em textos pré-gravados.

Esse método é aplicável a empresas com contornos completamente fechados. Relevante para bancos e outras organizações com altos requisitos de segurança.

O serviço usado no sistema de fila eletrônica QOne apresenta uma API simples e poderosa que permite receber mensagens de voz mp3 geradas com base em uma plataforma de voz de terceiros. 

As mensagens de voz são transmitidas em tempo real ou são formadas como um cache pré-criado de arquivos de áudio. O cache é construído com base em seus próprios algoritmos e na base interna do serviço.

Os serviços de voz modernos resolvem em um nível comparativamente alto a questão da imitação de pronúncia próxima à natural - os problemas de recriação de timbre de voz, suavidade de som e entonação são eliminados. Nossa solução utiliza todas as vantagens das tecnologias modernas de reconhecimento e síntese de voz dos maiores desenvolvedores mundiais.

Enviar solicitação

Deixe uma solicitação no formato de feedback e nossos especialistas entrarão em contato com você