Введение

Модель «источник-фильтр» представляет речь как комбинацию источника звука, такого как голосовые связки, и линейного акустического фильтра – речевого тракта. Несмотря на то, что это лишь приближение, модель широко используется в различных областях, таких как синтез и анализ речи, благодаря своей относительной простоте. Она также связана с линейным предсказанием. Разработка модели во многом обусловлена ранними работами Гуннара Фанта, хотя и другие исследователи, в частности Кен Стивенс, внесли значительный вклад в модели, лежащие в основе акустического анализа речи и синтеза речи. Фант опирался на работы Цутому Чибы и Масато Кадзиямы, которые первыми показали взаимосвязь между акустическими свойствами гласных и формой речевого тракта.

Приложения

В разной степени различные фонемы можно различить по характеристикам их источника (источников) и их спектральной форме. Звонкие звуки (например, гласные) имеют как минимум один источник, обусловленный преимущественно периодическим колебанием голосовых связок, которое можно аппроксимировать импульсной последовательностью во временной области и гармониками в частотной области, а также фильтром, зависящим, например, от положения языка и округления губ. С другой стороны, щелевые звуки, такие как и , имеют как минимум один источник, обусловленный турбулентным шумом, возникающим при сужении в ротовой полости или глотке. Так называемые звонкие щелевые звуки, такие как и , имеют два источника – один в голосовых связках и один в надгортанном сужении.

Синтез речи

При реализации модели производства речи, основанной на принципе "источник-фильтр", источник звука, или сигнал возбуждения, часто моделируется как периодический ряд импульсов для гласных и звонких согласных, или как белый шум для глухих согласных. Фильтр голосового тракта в простейшем случае аппроксимируется фильтром всех полюсов, коэффициенты которого определяются методом линейного предсказания для минимизации среднеквадратичной ошибки в речевом сигнале, подлежащем воспроизведению. Свертка сигнала возбуждения с импульсной характеристикой фильтра затем генерирует синтезированную речь.

Моделирование человеческой речевой продукции

В человеческой речи источником звука служат голосовые связки, которые могут производить периодический звук при сужении или апериодический (белый шум) звук при расслаблении. Фильтр – это остальная часть голосового тракта, способная изменять форму за счет манипуляций с глоткой, ротовой полостью и носовой полостью. Фант приблизительно сопоставляет источник и фильтр с фонацией и артикуляцией соответственно. Источник генерирует ряд гармоник различной амплитуды, которые распространяются по голосовому тракту и усиливаются или ослабляются для формирования речевого звука.