Введение
Параметрическое стерео (сокращенно PS) — это алгоритм сжатия звука, используемый в качестве формата кодирования звука для цифрового аудио. Он рассматривается как тип аудиообъекта MPEG 4 Part 3 (MPEG 4 Audio), предназначенный для повышения эффективности кодирования стерео аудиоматериалов с низкой пропускной способностью. Parametric Stereo цифровым способом кодирует стерео аудиосигнал, сохраняя аудио в монофоническом формате вместе с небольшим объемом дополнительной информации. Эта дополнительная информация (определяемая как "параметрический оверхед") описывает, как монофонический сигнал будет воспроизводиться в обоих стереоканалах, что позволяет при воспроизведении получить полноценное стереозвучание.
Предыстория
Расширенное аудиокодирование с пониженной сложностью (AAC LC) в сочетании со спектральной репликацией полос (SBR) и параметрическим стерео (PS) было определено как HE AAC v2. Декодер HE AAC v1 будет выдавать монозвук только при декодировании битового потока HE AAC v2. Параметрическое стерео выполняет разреженное кодирование в пространственной области, что в некоторой степени аналогично тому, что SBR делает в частотной области. Битовый поток AAC HE v2 получается путем сведения стереозвука к моно на кодировщике вместе с 2–3 кбит/с дополнительной информации (информации параметрического стерео) для описания пространственной интенсивности стереогенерации и восстановления звуковой атмосферы на декодере. Благодаря наличию дополнительной информации параметрического стерео вместе с моноаудиопотоком, декодер (плеер) может воссоздать точное пространственное приближение исходной стереопанорамы при очень низких битрейтах. Поскольку передается только один аудиоканал вместе с параметрической дополнительной информацией, кодированный аудиосигнал 24 кбит/с с параметрическим стерео будет значительно превосходить по качеству дискретные стереоаудиосигналы, закодированные обычными способами. Дополнительный битрейт, затраченный на единственный моноканал (в сочетании с некоторой дополнительной информацией PS), значительно улучшит воспринимаемое качество звука по сравнению со стандартным стереопотоком с аналогичным битрейтом. Однако эта техника полезна только при самых низких битрейтах (приблизительно 16–48 кбит/с и до 14,4 кбит/с в xHE AAC, используемом в DRM) для создания хорошего стереоэффекта, поэтому, хотя она может улучшить воспринимаемое качество при очень низких битрейтах, она обычно не обеспечивает прозрачности, поскольку имитация стереодинамики аудио с помощью этой техники ограничена и, как правило, ухудшает воспринимаемое качество независимо от битрейта.
Разработка
Разработка параметрического стерео была обусловлена необходимостью дальнейшего повышения эффективности кодирования аудио в стереосистемах с ограниченной полосой пропускания. Она прошла через множество итераций и улучшений, однако впервые была стандартизована как алгоритм при включении в функционал MPEG 4 Audio.
Подходы
Реализация в MPEG 4 основана на определении относительной величины, задержки и корреляции (когерентности) левого и правого каналов для каждой частотной полосы в смешанном моно-аудио. Особое внимание уделяется переходным сигналам, так как в противном случае данный подход привел бы к неприемлемым задержкам. По сравнению с кодированием на основе интенсивности стерео, которое не фиксирует задержку или корреляцию, PS может обеспечить более реалистичную звуковую сцену. В статье 2009 года к PS добавлено кодирование с использованием пилот-сигналов. Доклад, представленный на конференции в 2011 году, описывает использование дополнительной "остаточной информации" для записи и устранения артефактов PS. MPEG Surround использует технику, связанную с PS.