Тілді жазу жүйесімен жүйелі бейнелеу – транскрипция. Мағынасын аудару емес, сөйлеуді немесе мәтінді жазуға көшіру. Лингвистика, тіл технологиясында маңызды.
Ағылшыншамен салыстырыңыз: абзацты басыңыз — түпнұсқа терезеде ашылады. Абзац астындағы EN түймесі оны мәтін ішінде көрсетеді.
Мазмұны
Кіріспе
Тілді жазу түрінде жүйелі бейнелеу.
Systematic representation of language in written form
Тілдік мағынада транскрипция – ауызша тілді (айтылған сөз немесе есімдер тілі) немесе басқа жазу жүйесіндегі қолданыстағы мәтінді жазу түрінде жүйелі бейнелеу. Транскрипцияны мәтіннің мағынасын бір тілден екінші тілге аударуды білдіретін аудармамен (мысалы, Лос-Анджелес атауы испан тілінен аударғанда ағылшын тілінде "Періштелер" деген мағынаны береді) немесе бір жазудан екінші жазуға әріптерді ауыстыруды білдіретін транслитерациямен шатастыруға болмайды. Тіл білімі саласында транскрипция фонетика, әңгімелерді талдау, диалектология және социолингвистика сияқты әдістемелердің маңызды бөлігі болып табылады. Сондай-ақ, ол сөйлеу технологиясының бірнеше салаларында да маңызды рөл атқарады. Академиялық емес транскрипцияның кең таралған мысалдары – сот отырысының баяндамасы (сот хатшысы жасаған) немесе дәрігердің дауыстық жазбаларын жазу (медициналық транскрипция). Бұл мақала тіл біліміндегі транскрипцияға қатысты мәселелерді қарастырады.
Transcription in the linguistic sense is the systematic representation of spoken language in written form. The source can either be utterances (speech or sign language) or preexisting text in another writing system. Transcription should not be confused with translation, which means representing the meaning of text from a source language in a target language, (e. g. Los Angeles (from source language Spanish) means The Angels in the target language English); or with transliteration, which means representing the spelling of a text from one script to another. In the academic discipline of linguistics, transcription is an essential part of the methodologies of (among others) phonetics, conversation analysis, dialectology, and sociolinguistics. It also plays an important role for several subfields of speech technology. Common examples for transcriptions outside academia are the proceedings of a court hearing such as a criminal trial (by a court reporter) or a physician's recorded voice notes (medical transcription). This article focuses on transcription in linguistics.
Фонетикалық және орфографиялық транскрипция
Тілдік транскрипцияның екі негізгі түрі бар. Фонетикалық транскрипция сөйлеу тілінің фонетикалық және фонологиялық ерекшеліктеріне назар аударады. Сондықтан фонетикалық транскрипция жүйелері жеке дыбыстарды немесе фонемаларды жазбаша белгілерге шамадастау ережелерін ұсынады. Ал орфографиялық транскрипция жүйелері керісінше, белгілі бір тілдің орфографиялық нормаларына сәйкес айтылған сөздерді жазбаша түрге келтіру ережелерін қамтиды. Фонетикалық транскрипция көбінесе Халықаралық фонетикалық әліпби сияқты арнайы белгіленген таңбалар жиынтығымен жұмыс істейді. Қай транскрипция түрін таңдау көбінесе қолданылу контексіне байланысты. Фонетикалық транскрипция тілдің фонетикалық жаратылысын қатаң түрде баса көрсеткендіктен, көбінесе фонетикалық немесе фонологиялық талдаулар үшін қолданылады. Орфографиялық транскрипцияның болса, фонетикалық компонентпен қатар морфологиялық және лексикалық компоненттері де бар (бұл компоненттердің қаншалықты толық көрсетілуі тіл мен орфографияға байланысты). Осы себепті, ауызша тілдің семантикалық аспектілерін транскрипциялау қажет болғанда осы транскрипция түрі ыңғайлырақ. Фонетикалық транскрипция ғылыми тұрғыдан жүйелірек, бірақ оны үйрену қиын, орындауға көбірек уақыт кетеді және орфографиялық транскрипцияға қарағанда қолданылу аясы шектеулі.
There are two main types of linguistic transcription. Phonetic transcription focuses on phonetic and phonological properties of spoken language. Systems for phonetic transcription thus furnish rules for mapping individual sounds or phones to written symbols. Systems for orthographic transcription, by contrast, consist of rules for mapping spoken words onto written forms as prescribed by the orthography of a given language. Phonetic transcription operates with specially defined character sets, usually the International Phonetic Alphabet. The type of transcription chosen depends mostly on the context of usage. Because phonetic transcription strictly foregrounds the phonetic nature of language, it is mostly used for phonetic or phonological analyses. Orthographic transcription, however, has a morphological and a lexical component alongside the phonetic component (which aspect is represented to which degree depends on the language and orthography in question). This form of transcription is thus more convenient wherever semantic aspects of spoken language are transcribed. Phonetic transcription is more systematic in a scientific sense, but it is also more difficult to learn, more time consuming to carry out and less widely applicable than orthographic transcription.
Теория ретінде
Ауызша тілді жазбаша символдарға бейнелеу, көзқарасындай қарапайым процесс емес. Жазба тілі – бұл шектеулі, нақты және бөлек символдардан тұратын идеализация. Ал ауызша тіл – үздіксіз (дискреттің қарама-қарсысы) құбылыс, ол потенциалды шексіз компоненттерден құралған. Осы компоненттерді ажырату және жіктеуге арналған алдын ала белгіленген жүйе жоқ, демек, осы компоненттерді жазбаша символдарға сәйкестендірудің алдын ала белгіленген тәсілі де жоқ. Әдебиет транскрипция практикасының бейтарап еместігін көрсетуде тұрақты. Бейтарап транскрипция жүйесі болмайды және болуы да мүмкін емес. Әлеуметтік-мәдени білім транскрипт жасауға тікелей әсер етеді. Олар транскрипттің құрылымында көрінеді (Бейкер, 2005).
Mapping spoken language onto written symbols is not as straightforward a process as may seem at first glance. Written language is an idealization, made up of a limited set of clearly distinct and discrete symbols. Spoken language, on the other hand, is a continuous (as opposed to discrete) phenomenon, made up of a potentially unlimited number of components. There is no predetermined system for distinguishing and classifying these components and, consequently, no preset way of mapping these components onto written symbols. Literature is relatively consistent in pointing out the nonneutrality of transcription practices. There is not and cannot be a neutral transcription system. Knowledge of social culture enters directly into the making of a transcript. They are captured in the texture of the transcript (Baker, 2005).
CA (сүйлесуді талдау)
Кейбір деректерге сүйенсек, бұл өз түріндегі алғашқы жүйе, алғаш рет (Sacks et al. 1978) еңбегінде суреттелген, кейіннен (MacWhinney 2000) компьютерде оқылатын деректерде CA CHAT ретінде қолдануға бейімделген. Әңгімелесуді талдау саласының өзі транскрипцияға және транскрипциялық конвенциялар жиынтығына қатысты бірнеше ерекше тәсілдерді қамтиды. Олардың ішінде, басқалармен қатар, Джефферсон нотациясы бар. Әңгімелесуді талдау үшін жазылған деректер әдетте талдаушыларға қанағаттандыратын жазбаша түрге түсіріледі. Мұндай тәсілдердің екі түрі бар. Біріншісі, тар транскрипция деп аталады, ол әңгімелесудің өзара әрекеттесу ерекшеліктерін, мысалы, қай сөздерге баса назар түсірілгенін, қай сөздер жоғарырақ дауыспен айтылғанын, сөз кезегінің қай жерде үсті-үстіне келетінін, нақты сөздер қалай айтылғанын және т.б. қамтиды. Егер мұндай егжей-тегжейлі мәліметтер маңызды болмаса, мүмкін, талдаушы әңгімелесудің жалпы құрылымына немесе қатысушылар арасындағы сөз кезегінің салыстырмалы таралуына көбірек мән берген болса, онда кең транскрипция деп аталатын екінші транскрипция түрі жеткілікті болуы мүмкін (Уильямсон, 2009).
Arguably the first system of its kind, originally sketched in (Sacks et al. 1978), later adapted for the use in computer readable corpora as CA CHAT by (MacWhinney 2000). The field of Conversation Analysis itself includes a number of distinct approaches to transcription and sets of transcription conventions. These include, among others, Jefferson Notation. To analyze conversation, recorded data is typically transcribed into a written form that is agreeable to analysts. There are two common approaches. The first, called narrow transcription, captures the details of conversational interaction such as which particular words are stressed, which words are spoken with increased loudness, points at which the turns at talk overlap, how particular words are articulated, and so on. If such detail is less important, perhaps because the analyst is more concerned with the overall gross structure of the conversation or the relative distribution of turns at talk amongst the participants, then a second type of transcription known as broad transcription may be sufficient (Williamson, 2009).
Джефферсон транскрипциялық жүйесі
Джефферсон транскрипция жүйесі – Гейл Джефферсон әзірлеген, сөйлеуді жазуға арналған символдар жиынтығы. 1963 жылы ол Калифорния университетінің (UCLA) Халық денсаулығы департаментінде түрме күзетшілері үшін өткізілген тренингтерді жазу үшін кеңсе қызметкері ретінде жұмысқа орналасқанда, бұрын жазба дайындау тәжірибесі болғандықтан, Джефферсон Харви Сакстың алғашқы лекцияларының негізі болған жазбалардың бір бөлігін транскрипциялауды бастады. Төрт он жылдық бойы, оның көп бөлігінде университетте қызмет етпеген және жалақы алмаған Джефферсонның өзара әрекеттесудегі сөйлеуді зерттеуі, әңгімелесуді талдау (CA) деп белгіленген стандартты қалыптастырды. Оның еңбегі қарым-қатынасты әлеуметтанулық тұрғысынан зерттеуге, сондай-ақ лингвистика, коммуникация және антропология сияқты басқа да салаларға зор ықпал етті. Бұл жүйе CA перспективасынан жұмыс істейтін барлық зерттеушілер тарапынан кеңінен қолданылады және транскрипциялау бойынша жаһандық нұсқаулар жиынтығы ретінде танылады.
The Jefferson Transcription System is a set of symbols, developed by Gail Jefferson, which is used for transcribing talk. Having had some previous experience in transcribing when she was hired in 1963 as a clerk typist at the UCLA Department of Public Health to transcribe sensitivity training sessions for prison guards, Jefferson began transcribing some of the recordings that served as the materials out of which Harvey Sacks' earliest lectures were developed. Over four decades, for the majority of which she held no university position and was unsalaried, Jefferson's research into talk in interaction has set the standard for what became known as conversation analysis (CA). Her work has greatly influenced the sociological study of interaction, but also disciplines beyond, especially linguistics, communication, and anthropology. This system is employed universally by those working from the CA perspective and is regarded as having become a near globalized set of instructions for transcription.
DT (сөйлеуді транскрипциялау)
(Дубуа және басқалар) 1992 жылы сипатталған, Америка тіліндегі сөйлеу деректерінің Санта-Барбара корпусын (SBCSAE) жазуға қолданылған жүйе, кейін DT2 ретінде одан әрі жетілдірілді.
A system described in (DuBois et al. 1992), used for transcription of the Santa Barbara Corpus of Spoken American English (SBCSAE), later developed further into DT2.
GAT (Gesprächsanalytisches Transkriptionssystem Әңгімелесуді талдау транскрипция жүйесі)
(Selting және басқалар, 1998) сипатталған, кейіннен GAT2 ретінде дамытылған (Selting және басқалар, 2009) жүйе, неміс тілді елдерде әңгімелесуді прозодикалық тұрғыдан талдау және интеракциялық лингвистика салаларында кеңінен қолданылады.
A system described in (Selting et al. 1998), later developed further into GAT2 (Selting et al. 2009), widely used in German speaking countries for prosodically oriented conversation analysis and interactional linguistics.
HIAT (Halbinterpretative Arbeitstranskriptionen Жартылай интерпретациялық жұмыс транскрипциялары)
Кейбір деректерге сүйенсек, бұл өз түріндегі алғашқы жүйе, алғаш рет (Ehlich and Rehbein 1976) еңбегінде сипатталған. (Ehlich 1992) – ағылшын тіліндегі анықтамасы үшін қараңыз – компьютерде оқылатын мәліметтерде қолдануға бейімделген (Rehbein et al. 2004) және функционалдық прагматикада кеңінен қолданылады.
Arguably the first system of its kind, originally described in (Ehlich and Rehbein 1976) – see (Ehlich 1992) for an English reference adapted for the use in computer readable corpora as (Rehbein et al. 2004), and widely used in functional pragmatics.
Бағдарламалық жасақтама
Транскрипция бастапқыда қолмен, яғни қарындаш пен қағазбен, мысалы, компакт-кассетаға сақталған аналогты дыбыс жазу арқылы жүргізілетін процесс болды. Бүгінде көптеген транскрипциялар компьютерде жасалады. Жазбалар көбінесе цифрлық аудио немесе бейне файлдар түрінде болады, ал транскрипциялар электрондық құжаттар болып табылады. Цифрлық жазбадан цифрлық транскрипцияны тиімді жасауға транскрипторға көмектесетін арнайы компьютерлік бағдарламалық жасақтама бар. Транскрипция процесіне көмектесу үшін екі түрлі транскрипция бағдарламалық жасақтама қолданылуы мүмкін: біреуі қолмен транскрипцияны жеңілдетеді, ал екіншісі автоматтандырылған транскрипцияны жеңілдетеді. Алғашқысында жұмыс әлі де адам транскрипторымен жасалады, ол жазбаны тыңдап, естігенін компьютерге теріп жазады, мұндай бағдарламалық жасақтама көбінесе мультимедиа ойнатқыш болып табылады және ойнату немесе жылдамдықты өзгерту сияқты мүмкіндіктерге ие. Екіншісінде автоматтандырылған транскрипция аудио немесе бейне файлдарды электрондық мәтінге түрлендіретін сөйлеуді мәтінге айналдыру жүйесі арқылы жүзеге асырылады. Кейбір бағдарламалық жасақтамаларда түсіндірмелер қосу функциясы да бар.
Transcription was originally a process carried out manually, i. e. with pencil and paper, using an analogue sound recording stored on, e. g., a Compact Cassette. Nowadays, most transcription is done on computers. Recordings are usually digital audio files or video files, and transcriptions are electronic documents. Specialized computer software exists to assist the transcriber in efficiently creating a digital transcription from a digital recording. Two types of transcription software can be used to assist the process of transcription: one that facilitates manual transcription and the other automated transcription. For the former, the work is still very much done by a human transcriber who listens to a recording and types up what is heard in a computer, and this type of software is often a multimedia player with functionality such as playback or changing speed. For the latter, automated transcription is achieved by a speech to text engine which converts audio or video files into electronic text. Some of the software would also include the function of annotation.