Введение

Компьютерно-читаемый фонетический шрифт

NOTOC
Фонетический алфавит методов оценки речи (SAMPA) — это компьютерно-читаемый фонетический шрифт, использующий 7-битные печатные символы ASCII, основанный на Международном фонетическом алфавите (IPA). Он был первоначально разработан в конце 1980-х годов для шести европейских языков в рамках исследовательской и опытно-конструкторской программы ESPRIT по информационным технологиям Европейского экономического сообщества. Максимальное количество символов было перенято из IPA; в тех случаях, когда это невозможно, используются другие доступные знаки, например, [@] для шва (IPA), [2] для гласного звука, встречающегося во французском слове *deux* «два» (IPA), и [9] для гласного звука, встречающегося во французском слове *neuf* «девять» (IPA). На сегодняшний день SAMPA официально разработана для всех звуков следующих языков:

Арабский
Болгарский
Кантонский
Чешский
Датский
Голландский
Английский
Эстонский
Французский
Немецкий
Греческий
Иврит
Венгерский
Итальянский
Норвежский
Польский
Португальский
Румынский
Русский
Шотландский
Сербскохорватский
Словацкий
Словенский
Испанский
Шведский
Тайский
Турецкий

Символы ["s{mp@] представляют произношение имени SAMPA на английском языке, при этом начальный символ ["] указывает на основное ударение. Как и IPA, SAMPA обычно заключается в квадратные скобки или косые черты, которые не являются частью самого алфавита и лишь указывают на то, что это фонетическая, а не обычная запись.

Особенности

SAMPA был разработан в конце 1980-х годов в рамках проекта ESPRIT 2589 "Методы оценки речи" (SAM), финансируемого Европейской комиссией, – отсюда и название "Фонетический алфавит SAM" – для упрощения обмена данными по электронной почте и вычислительной обработки транскрипций в фонетике и технологиях речи. SAMPA является частичной кодировкой МФА (Международного фонетического алфавита). Первая версия SAMPA представляла собой объединение наборов кодов фонем для датского, голландского, английского, французского, немецкого и итальянского языков; последующие версии расширили SAMPA для охвата других европейских языков. Поскольку SAMPA основана на инвентарях фонем, каждая таблица SAMPA действительна только для языка, для которого она была разработана. Чтобы сделать эту технику кодирования МФА универсально применимой, был создан X SAMPA, предоставляющий единую таблицу без языковых различий. SAMPA был разработан как временное решение для обхода невозможности представления символов МФА в текстовых кодировках. Соответственно, по мере распространения поддержки Unicode для символов МФА необходимость в отдельной, машиночитаемой системе для представления МФА в ASCII снижается. Однако ввод текста по-прежнему зависит от конкретных кодировок клавиатуры или устройств ввода. По этой причине SAMPA и X SAMPA до сих пор широко используются в вычислительной фонетике и технологиях речи.