Сервіс синтезу мовлення

Електронна черга QOne пропонує власний сервіс синтезу мовлення для розгортання голосового помічника в додаток до систем автоматизації клієнтських потоків. Наше рішення — це високоефективний кешувальний сервіс з можливістю автоматичного поповнення бази повідомлень через зовнішні сервіси синтезу мовлення (Google Text-to-Speech або Responsive Voice).

Переваги сервісу синтезу мовлення

  • Низька вартість генерації нових файлів. Наприклад, для бази звукових файлів на основі Google Text-to-Speech ціна складає 16 USD за 1 млн. символів
  • Зниження вартості володіння сервісом за рахунок сегментування повідомлень. Кожний унікальний сегмент озвучується лише один раз
  • Власні алгоритми нормалізації повідомлень, які дозволяють ще більше знизити звернення до зовнішніх сервісів

Google Text-to-Speech

  • Підтримка 120+ мов та мовних різновидів
  • Точне вимовляння, форматування фраз в залежності від мовної ситуації (наприклад, дати, номери телефонів)
  • Високий рівень імітації мовлення, наближений до реального життя
  • Підтримка мови розмітки синтезу мовлення (Speech Synthesis Markup Language), що базується на XML

Відгукнутий Голос

  • Сервіс звукового аналізу від компанії Responsive Voice
  • Підтримка 42 мов
  • Перетворення тексту в мову на основі прихованих марківських моделей
  • Інтонація задається нейромережею, навченою на багатьох прикладах з реального життя

Сервіс на основі попередньо записаних текстів

У разі необхідності наша електронна черга може використовувати сервіс на основі попередньо записаних текстів.

Такий підхід знаходить застосування в компаніях, у яких повністю закриті контури. Актуально для банків та інших організацій з високими вимогами до безпеки.

Використаний в системі Електронної черги QOne сервіс представляє простий і потужний API, який дозволяє отримувати сформовані на основі сторонньої голосової платформи mp3 голосові повідомлення. 

Голосові повідомлення передаються в режимі реального часу або формуються у вигляді попередньо створеного кешу зі звукових файлів. Кеш будується на основі власних алгоритмів та внутрішньої бази сервісу.

Сучасні голосові сервіси на порівняно високому рівні вирішують питання імітації вимови, близької до природної - вирішені проблеми з відтворенням тембру голосу, плавності звучання та інтонації. Створене нами рішення використовує всі переваги сучасних технологій з розпізнавання та озвучування від найбільших світових розробників.

Надіслати заявку

Залиште заявку у форматі зворотнього зв'язку і наші спеціалісти зв'яжуться з Вами