23 сентября в 06:10

Neuro.net представила новое поколение ИИ-синтеза речи

Возвращаем к оригиналу....
Российская компания Neuro.net представила новое поколение технологии синтеза речи, в которой большие языковые и диффузионные модели совместно генерируют голос с учетом его акустических особенностей и контекста, делая звучание более естественным.ТАСС
В потоковом режиме Neuro TTS начинает передавать аудиоданные через 120 миллисекунд после поступления запроса, что позволяет начинать воспроизведение до завершения генерации всей реплики.ТАСС
Разработка технологии опирается на практический опыт компании в автоматизации контакт-центров.ТАСС
В таких проектах синтез речи является частью полноценного диалога: голосовой AI должен распознать речь клиента, определить его намерение, сформировать релевантный ответ и озвучить его таким образом, чтобы разговор оставался естественным и управляемым.ТАСС
Источники:
IT
5,67 млн интересуются
Добавить в корзинуПозвонить