Российская компания разработала новую технологию синтеза речи для голосовых ИИ

Российская компания Neuro.net представила новую технологию синтеза речи Neuro TTS. В ней большие языковые и диффузионные модели совместно генерируют голос с учетом акустических особенностей и контекста, пишет ТАСС.

Платформа уже доступна для бизнеса. Синтез можно встраивать в сервисы через программный интерфейс. В потоковом режиме аудиоданные начинают передаваться через 120 миллисекунд после запроса, что позволяет воспроизводить речь до завершения генерации.

Технология опирается на опыт компании в автоматизации контакт-центров. Голосовой искусственный интеллект должен распознать речь клиента, определить намерение, сформировать ответ и озвучить его естественно.

Глава группы компаний Александр Цепелев отметил, что развитие искусственного интеллекта в России не должно быть территорией нескольких корпораций. Независимые компании тоже должны задавать темп рынку. Он подчеркнул, что Neuro.net годами развивает собственные технологии разговорного искусственного интеллекта и готова создавать конкуренцию.

Источник: www.ferra.ru

0 0 голоса
Рейтинг новости
1
0
Подписаться
Уведомить о
0 комментариев