?
Метод кодирования голосового источника турбулентного типа на основе гибридной модели линейного предсказания
В рамках актуального направления исследований в области речевой акустики – неинвазивного анализа
процессов речеобразования – рассмотрена острая проблема недостаточной точности параметрических методов кодирования голосового источника турбулентного (шумового) типа. Для решения указанной проблемы разработан метод кодирования, основанный на гибридной модели линейного предсказания, в которой совмещаются преимущества параметрического и непараметрического подходов к моделированию речевых сигналов. Параметрический подход реализован в форме вектора коэффициентов линейного предсказания, а непараметрический подход – в форме клиппированной последовательности отсчётов ошибки линейного предсказания. С использованием авторского программного обеспечения поставлен и проведён натурный эксперимент над множеством звуков шёпотной речи контрольного диктора. Показано, что по сравнению с известным методом кодирования турбулентного источника на основе модели линейного предсказания
с шумовым возбуждением разработанный метод характеризуется выигрышем 2,5 дБ и более в метрике относительного среднего квадратического значения ошибки линейного предсказания при гарантированной узнаваемости голоса диктора по декодированному (восстановленному) речевому сигналу. Полученные результаты будут полезны при разработке малозатратных систем и технологий цифровой обработки, синтеза и передачи речи с многократным сжатием данных. К числу перспективных направлений применения разработанного метода относятся системы цифровой голосовой биометрии, в которых узнаваемость голоса диктора является ключевым требованием к методу кодирования речевого сигнала.