Введение

Термин "подавление тишины" используется в телефонии для описания процесса прекращения передачи информации по сети, когда один из участников телефонного разговора молчит, что позволяет снизить использование полосы пропускания. Голос передается по цифровой телефонной сети путем преобразования аналогового сигнала в цифровой, который затем пакетируется и передается по сети в электронном виде. Аналоговый сигнал восстанавливается на принимающей стороне сети. Когда один из участников молчит, фоновый шум регистрируется и передается по сети. Это неэффективно, так как данный сигнал не содержит полезной информации и, следовательно, приводит к потере пропускной способности. Учитывая, что обычно в разговоре говорит только один человек, подавление тишины может обеспечить общую экономию пропускной способности до 50% в течение всего телефонного звонка. (Хотя иногда обе стороны могут говорить одновременно, бывают моменты, когда обе стороны молчат.) Подавление тишины достигается путем распознавания отсутствия речи с помощью механизма обработки речи, называемого определением голосовой активности (VAD), который динамически отслеживает фоновый шум и устанавливает соответствующий порог обнаружения речи. Этот метод также известен как определение речевой активности (SAD). Аналогичный принцип применяется в системах мобильной связи GSM для прерывистого приема и прерывистой передачи. Для дальнейшей оптимизации использования полосы пропускания подавление тишины обычно выполняется после подавления эхосигнала.

Недостатки

В некоторых случаях обнаружение фонового шума может быть затруднено (например, при относительно низком уровне речи или относительно высоком уровне фонового шума). Когда подавление тишины активно, на другом (выходном) конце вызова линия может казаться отключенной. По этой причине необходимо генерировать так называемый комфортный шум для компенсации отсутствия фонового шума. Входной конец, следовательно, должен сигнализировать выходному концу о том, что подавление тишины включено. Для достижения оптимальных результатов уровень генерируемого на выходном конце комфортного шума должен соответствовать уровню фонового шума на входном конце. Обнаружение речевой активности должно происходить очень быстро, иначе может возникнуть обрезка сигнала. Обнаружение речевой активности работает неэффективно при неречевых вызовах (например, при факсимильной связи или передаче данных через модем). Таким образом, подавление тишины обычно является необязательной функцией на телефонных устройствах. В некоторых случаях оно включается автоматически на основе характеристик вызова.