Компания «Криптонит» разработала модель искусственного интеллекта (ИИ), которая определяет язык речи по короткому голосовому фрагменту. Система анализирует акустические и фонетические характеристики аудиосигнала, пишет ТАСС.
Модель обучили на открытой языковой модели, название которой разработчики не раскрывают. По данным компании, новая система содержит 219 млн параметров против 1 млрд у исходной модели. При этом скорость обработки примерно в 10 раз выше, а отклонение по точности составляет менее 1%.
По словам исследователя направления обработки аудиоданных в компании Александра Самойлова, технология может применяться при обработке больших объемов аудио, в том числе в службах поддержки и у операторов связи. Там система сможет работать с миллионами записей без пропорционального увеличения вычислительной инфраструктуры.
Источник: www.ferra.ru