Российская компания Neuro.net представила новую технологию синтеза речи Neuro TTS. В ней большие языковые и диффузионные модели совместно генерируют голос с учетом акустических особенностей и контекста, пишет ТАСС.
Платформа уже доступна для бизнеса. Синтез можно встраивать в сервисы через программный интерфейс. В потоковом режиме аудиоданные начинают передаваться через 120 миллисекунд после запроса, что позволяет воспроизводить речь до завершения генерации.
Технология опирается на опыт компании в автоматизации контакт-центров. Голосовой искусственный интеллект должен распознать речь клиента, определить намерение, сформировать ответ и озвучить его естественно.
Глава группы компаний Александр Цепелев отметил, что развитие искусственного интеллекта в России не должно быть территорией нескольких корпораций. Независимые компании тоже должны задавать темп рынку. Он подчеркнул, что Neuro.net годами развивает собственные технологии разговорного искусственного интеллекта и готова создавать конкуренцию.
Источник: www.ferra.ru