Группа студентов из НИУ ВШЭ и компании VK представила свой проект, посвященный улучшению качества речи (Speech Enhancement, SE) с использованием нейросетевых технологий. Они разработали метод, который позволяет не загружать весь речевой сигнал в одну нейросеть, а разделять его на части, что дает возможность разным экспертам работать с различными типами шумов.
В ходе работы над проектом студенты столкнулись с рядом вызовов, связанных с обработкой шумов, и нашли решения, которые позволили значительно повысить качество обработки речевых сигналов. Их подход включает в себя интеграцию различных технологий и методов, что делает его более гибким и адаптивным к различным условиям.
Этот проект демонстрирует важность междисциплинарного подхода в разработке технологий искусственного интеллекта. Успех студентов может способствовать дальнейшему развитию технологий Speech Enhancement и их применению в различных сферах, таких как телекоммуникации и голосовые ассистенты.