 |
Компания BSS в 10 раз сократила требования к объему аудиоматериалов для создания нового голоса бота
Голосовой робот BSS успешно консультирует клиентов максимально естественным голосом с человеческими интонациями. Новый мужской голос создан на основе голоса профессионального диктора, озвучившего необходимые для ведения диалогов с клиентами фразы. Озвучивание переменных данных (ФИО, улица, дата, номер и т.д.) производится на основе синтеза голоса этого диктора. Такой гибридный подход позволяет существенно сократить время на обучение модели, при этом обеспечить естественность, плавность и незаметность всех переходов и вставок. В процессе создания нового голоса команда BSS отобрала целевую лексику, которую использует робот при общении с абонентами в реальных проектах. Это помогло отобрать необходимые фразы и, тем самым, сократить количество используемых для обучения модели аудиоматериалов. Более того, команда подобрала специальный фонетический корпус, в котором обеспечено максимальное разнообразие трезвучий (включая редкие), что обеспечивает естественное и приятное звучание голоса. Собранные фразы были озвучены диктором. Для обучения модели, отвечающей за синтез голоса, понадобились 2 часа аудиозаписей вместо 15-20 часов, как было ранее. Синтезированный голос получился естественным, поскольку модель улавливала и учитывала интонации диктора. Такой способ обучения модели позволяет минимизировать разницу между ранее записанным голосом и синтезированным. «Мы смогли сократить длительность требуемых материалов с 15-20 часов до 2 часов, что позволяет нам выполнять проекты в более короткие сроки. Модель синтеза речи реализовали на новой архитектуре Conformer — это более современная архитектура нейронной сети, которая лучше справляется с синтезом длинных фраз. Если раньше мы сталкивались с «зажевыванием» в конце предложений, то теперь эта проблема минимизирована и длинные фразы звучат корректно. Естественность и качество нового голоса, скорость его создания – важные преимущества для любого проекта по внедрению и развитию виртуального ассистента», — прокомментировал директор департамента голосовых цифровых технологий компании BSS Александр Крушинский.
Контактное лицо: Вадим Прищепа
Компания: BSS
Добавлен: 01:09, 15.06.2024
Количество просмотров: 234
Страна: Россия
«1С-Рарус» провел исследование эффективности дроп-дисплеев в обувной сети, 1С-Рарус, 21:11, 17.10.2025, Россия300 |
Эксперты «1С-Рарус» провели исследование эффективности рекламы на дроп-дисплеях в сети магазинов обувного ритейлера в трех крупных ТЦ Москвы. Системы видеоаналитики показали: несмотря на изменения трафика торговых центров, дроп-дисплеи стабильно привлекают внимание покупателей и способствуют росту посещаемости магазинов сети. |
PLM-система САРУС+ включена в реестр отечественного ПО, НКК, 20:57, 17.10.2025, Россия89 |  |
Программный комплекс САРУС+ для управления жизненным циклом изделий, разработанный в «Национальной компьютерной корпорации» (НКК), зарегистрирован в Едином реестре российского программного обеспечения Минцифры России (регистрационный номер №29601, класс 08.01). |
ATLAS расширил функциональность систем хранения данных, ATLAS, 20:19, 17.10.2025, Россия79 |
Компания ATLAS, разработчик и производитель решений для хранения, обработки и передачи данных, представила мажорное обновление системы управления для СХД ATLAS. Выпущенная версия позволит заказчикам получить более устойчивую, гибкую и масштабируемую платформу, поддерживающую развитие цифровых сервисов, рост объёмов данных и интеграцию с современными технологиями, обеспечивая долгосрочную эффективность всей инфраструктуры. |
|
 |