Введение
Компьютерно-читаемый фонетический шрифт
NOTOC
Фонетический алфавит методов оценки речи (SAMPA) — это компьютерно-читаемый фонетический шрифт, использующий 7-битные печатные символы ASCII, основанный на Международном фонетическом алфавите (IPA). Он был первоначально разработан в конце 1980-х годов для шести европейских языков в рамках исследовательской и опытно-конструкторской программы ESPRIT по информационным технологиям Европейского экономического сообщества. Максимальное количество символов было перенято из IPA; в тех случаях, когда это невозможно, используются другие доступные знаки, например, [@] для шва (IPA), [2] для гласного звука, встречающегося во французском слове *deux* «два» (IPA), и [9] для гласного звука, встречающегося во французском слове *neuf* «девять» (IPA). На сегодняшний день SAMPA официально разработана для всех звуков следующих языков:
The Speech Assessment Methods Phonetic Alphabet (SAMPA) is a computer readable phonetic script using 7 bit printable ASCII characters, based on the International Phonetic Alphabet (IPA). It was originally developed in the late 1980s for six European languages by the EEC ESPRIT information technology research and development program. As many symbols as possible have been taken over from the IPA; where this is not possible, other signs that are available are used, e. g. [@] for schwa (IPA ), [2] for the vowel sound found in French deux 'two' (IPA ), and [9] for the vowel sound found in French neuf 'nine' (IPA ). Today, officially, SAMPA has been developed for all the sounds of the following languages:
Арабский
Болгарский
Кантонский
Чешский
Датский
Голландский
Английский
Эстонский
Французский
Немецкий
Греческий
Иврит
Венгерский
Итальянский
Норвежский
Польский
Португальский
Румынский
Русский
Шотландский
Сербскохорватский
Словацкий
Словенский
Испанский
Шведский
Тайский
Турецкий
Bulgarian
Cantonese
Czech
Danish
Dutch
English
Estonian
French
German
Greek
Hebrew
Hungarian
Italian
Norwegian
Polish
Portuguese
Romanian
Russian
Scots
Serbo Croatian
Slovak
Slovenian
Spanish
Swedish
Thai
Turkish
Символы ["s{mp@] представляют произношение имени SAMPA на английском языке, при этом начальный символ ["] указывает на основное ударение. Как и IPA, SAMPA обычно заключается в квадратные скобки или косые черты, которые не являются частью самого алфавита и лишь указывают на то, что это фонетическая, а не обычная запись.
Особенности
SAMPA был разработан в конце 1980-х годов в рамках проекта ESPRIT 2589 "Методы оценки речи" (SAM), финансируемого Европейской комиссией, – отсюда и название "Фонетический алфавит SAM" – для упрощения обмена данными по электронной почте и вычислительной обработки транскрипций в фонетике и технологиях речи. SAMPA является частичной кодировкой МФА (Международного фонетического алфавита). Первая версия SAMPA представляла собой объединение наборов кодов фонем для датского, голландского, английского, французского, немецкого и итальянского языков; последующие версии расширили SAMPA для охвата других европейских языков. Поскольку SAMPA основана на инвентарях фонем, каждая таблица SAMPA действительна только для языка, для которого она была разработана. Чтобы сделать эту технику кодирования МФА универсально применимой, был создан X SAMPA, предоставляющий единую таблицу без языковых различий. SAMPA был разработан как временное решение для обхода невозможности представления символов МФА в текстовых кодировках. Соответственно, по мере распространения поддержки Unicode для символов МФА необходимость в отдельной, машиночитаемой системе для представления МФА в ASCII снижается. Однако ввод текста по-прежнему зависит от конкретных кодировок клавиатуры или устройств ввода. По этой причине SAMPA и X SAMPA до сих пор широко используются в вычислительной фонетике и технологиях речи.