Ағылшыншамен салыстырыңыз: абзацты басыңыз — түпнұсқа терезеде ашылады. Абзац астындағы EN түймесі оны мәтін ішінде көрсетеді.
Мазмұны
Кіріспе
Жеке адамның тілдегі айтылу және грамматика үлгілері.
An individual's patterns of pronunciation and grammar of a language
Идиолект – адамның тілді ерекше қолдануы, соның ішінде сөйлеуін қамтиды. Бұл ерекше қолданыс сөздік қорын, грамматиканы және айтылу ерекшеліктерін қамтиды. Бұл диалекттен өзгеше, яғни белгілі бір топ адамдардың ортақ тілдік ерекшеліктерінен айырмашылығы бар. Бұл термин этимологиялық тұрғыдан грек тіліндегі idio префиксімен ("жеке, дербес, ерекше, бөлек") және диалекттен алынған "лект" түбірімен, сондай-ақ ежелгі грек тіліндегі λέγω сөзімен байланысты.
Idiolect is an individual's unique use of language, including speech. This unique usage encompasses vocabulary, grammar, and pronunciation. This differs from a dialect, a common set of linguistic characteristics shared among a group of people. The term is etymologically related to the Greek prefix idio (meaning "own, personal, private, peculiar, separate, distinct") and lect, abstracted from dialect, and ultimately from Ancient Greek λέγω.
Тіл
Тіл сөйлем құрылыстарынан, сөздерді таңдаудан және стильдік өрнектерден тұрады, ал идиолект – жеке адамның осы элементтерді қолдануын қамтиды. Әр адамның тілі, әлеуметтік-экономикалық жағдайы және географиялық орналасуына байланысты ерекше идиолекті болады. Сот лингвистикасы идиолектілерді психологиялық тұрғыдан талдайды. Тіл ұғымы тілдің қолданылуын, сондай-ақ жеке сөйлеушілер мен тыңдаушылардың қабілеттерін абстрактілі түрде сипаттау үшін қолданылады. Осы көзқарас бойынша, тіл – "өздігінен бірлік емес, идиолекттердің жиынтығы". Тіл білімі мамандары нақты тілдерді ана тілінде сөйлейтін адамдардың айтқан сөздерін зерттеу арқылы талдайды. Бұл, кем дегенде АҚШ-та, тіл білмейтіндер арасында тілдердің тіл қолданушыларының нақты практикасынан тысқары тұратын идеалдық жүйелер екендігі туралы пікірмен қарама-қайшы келеді. АҚШ-та жүргізілген зерттеулер негізінде Нэнси Нидзиелски мен Дэннис Престон америкалық ағылшын тілінде сөйлейтіндер арасында кең таралған тіл идеологиясын сипаттайды. Нидзиелски мен Престонның сөзіне сүйенсек, олардың көптеген қатысушылары стандарттық ағылшынның негізінде жатқан грамматика мен сөздіктің бір "дұрыс" үлгісі бар екеніне және жеке қолдану осы сыртқы жүйеден туындайды деп санайды. Тіл білімі мамандары нақты тілдерді бірегей, жеке идиолекттердің жиынтығы ретінде қарастырғанмен, үлкен тілдік қауымдастықтардың мүшелерінің, тіпті бір тілдің әртүрлі диалектілерін сөйлейтіндердің бір-бірін түсіне алатындығын ескеруі керек. Барлық адамдар тілді шамамен бірдей қағидалар бойынша құрастырады. Бұл жалпыға ортақ грамматиканы іздеуге, сондай-ақ нақты тілдердің мәнін анықтауға бағытталған зерттеулерге әкелді.
Language consists of sentence constructs, word choices, and expressions of style, and an idiolect comprises an individual's uses of these facets. Every person has a unique idiolect influenced by their language, socioeconomic status, and geographical location. Forensic linguistics psychologically analyzes idiolects. The notion of language is used as an abstract description of the language use, and of the abilities of individual speakers and listeners. According to this view, a language is an "ensemble of idiolects rather than an entity per se". Linguists study particular languages by examining the utterances produced by native speakers. This contrasts with a view among non linguists, at least in the United States, that languages as ideal systems exist outside the actual practice of language users. Based on work done in the US, Nancy Niedzielski and Dennis Preston describe a language ideology seemingly common among American English speakers. According to Niedzielski and Preston, many of their subjects believe that there is one "correct" pattern of grammar and vocabulary that underlies Standard English, and that individual usage comes from this external system. Linguists who understand particular languages as a composite of unique, individual idiolects must nonetheless account for the fact that members of large speech communities, and even speakers of different dialects of the same language, can understand one another. All human beings seem to produce language in essentially the same way. This has led to searches for universal grammar, as well as attempts to further define the nature of particular languages.
Сот лингвистикасы
Сот лингвистикасы мәтіннің стилін сол адамның идиолектісімен салыстыру арқылы адамның белгілі бір мәтінді жазғанын анықтауға бағытталған зерттеулерді қамтиды. Сот лингвисті мәтіннің аталған тұлғаға сәйкес келетінін, оны автор ретінде жоққа шығаратынын немесе салыстыруды шешім қабылдауға жеткіліксіз деп таба алады. 1995 жылы Макс Аппедоль Рафаэль Себастьян Гиллен Висентенің жазу стилін талдау нәтижесінде оны сапатистік қозғалыстың жетекшісі Субкоманданте Маркос екенін анықтады. Мексика үкіметі Субкоманданте Маркосты қауіпті партизан деп есептесе де, Аппедоль үкіметті Гилленнің бейбітшіл екеніне көндірді. Аппедольдің талдауы құқық қорғау органдарында сот лингвистикасын қылмыстық профильдеу үшін қолданудың алғашқы жетістігі деп саналады. 1998 жылы Тед Качински сот лингвистикасы арқылы «Унабомбер» ретінде танылды. ФБР және Бас прокурор Джанет Рено Качинскидің эссесін жариялауға ынталандырды, бұл Качинскидің ағасынан хабар түюіне себеп болды, ол жазу стилін, оның идиолектісін таныды. 1978 жылы төрт адам Карл Бриджвотерді өлтіргені үшін сотталды. Олардың ісіне сол кезде сот лингвистикасының қатысы болған жоқ. Бүгінде сот лингвистикасы көрсеткендей, ер адамдардың бірінен алынған сұхбатта қолданылған идиолекті оның бұрынғы мәлімдемесімен өте ұқсас. Идиолектілер әр адамға тән болғандықтан, сот лингвистикасы осы файлдардың бірі екіншісін пайдаланбастан жасалғанының ықтималдығы өте төмен екенін көрсетеді.
Forensic linguistics includes attempts to identify whether a person produced a given text by comparing the style of the text with the idiolect of the individual in question. The forensic linguist may conclude that the text is consistent with the individual, rule out the individual as the author, or deem the comparison inconclusive. In 1995, Max Appedole relied in part on an analysis of Rafael Sebastián Guillén Vicente's writing style to identify him as Subcomandante Marcos, a leader of the Zapatista movement. Although the Mexican government regarded Subcomandante Marcos as a dangerous guerrilla, Appedole convinced the government that Guillén was a pacifist. Appedole's analysis is considered an early success in the application of forensic linguistics to criminal profiling in law enforcement. In 1998, Ted Kaczynski was identified as the "Unabomber" by means of forensic linguistics. The FBI and Attorney General Janet Reno pushed for the publication of an essay of Kaczynski's, which led to a tip off from Kaczynski's brother, who recognized the writing style, his idiolect. In 1978, four men were convicted of murdering Carl Bridgewater. No forensic linguistics was involved in their case at the time. Today, forensic linguistics reflects that the idiolect used in the interview of one of the men was very similar to that man's reported statement. Since idiolects are unique to an individual, forensic linguistics reflects that it is very unlikely that one of these files was not created by using the other.
Идиолектілерді корпустармен анықтау
Идиолектілік талдау жеке адам үшін талдауға алынатын деректер мәтіндерден немесе аудио файлдардан тұратын корпустың құрамына байланысты өзгеше болады, себебі жазбаша жұмыс жоспарлау кезінде ойластырылып, сөздері нақтырақ келтіріледі, ал спонтанды сөйлеу бейресми тілге және әңгімелерді толтыру үшін қолданылатын сөздерге ("ммм", "білесіз бе" сияқты) толы болады. Көп көлемді деректерді қамтитын корпус сөздердің жиілігі мен синонимдердің тізімдерін жасауға мүмкіндік береді, әдетте, одан құрылған ең көп қолданылатын он биграмма арқылы. Мұндай жағдайда сөздің қолданылу контексі, әсіресе берілген биграмманың дұрыстығын анықтау кезінде ескеріледі. Сөздің немесе сөз тіркесінің идиолектіге жататыны оның терезенің бас сөзімен салыстырғандағы орналасуы арқылы анықталады. Бұл терезе 7-10 сөзден тұрады, ал идиолектінің ерекшелігі ретінде қарастырылатын үлгі терезенің "бас" сөзінен +5/-5 сөз қашықтықта болуы мүмкін (әдетте ортасында). Идиолектіге қатысты деректер корпуста үш санатқа бөлінеді: маңызсыз, жеке сөздік маркерлер және бейресми сөздік. Фреймнің соңындағы және бас сөзден алыс орналасқан үлгілер көбінесе артық деп есептеледі. Артық және артық емес деректер әртүрлі функциялар арқылы өңделіп, берілген сөздердің немесе сөз тіркестерінің жеке адамның идиолектісінің бөлігі болып табылатынын анықтауға мүмкіндік береді.
Idiolect analysis is different for an individual depending on whether the data being analyzed is from a corpus made up entirely from texts or audio files, since written work is more thought out in planning and precise in wording than in spontaneous speech, which is full of informal language and conversation fillers, e. g. "umm " and "you know". Corpora with large amounts of input data allow for the generation of word frequency and synonym lists, normally through the use of the top ten bigrams created from it. In such a situation, the context of word usage is considered, particularly when determining the legitimacy of a given bigram. Whether a word or phrase is part of an idiolect is determined by the word's location compared with the window's head word, the edge of the window. This window is kept to 7 10 words, with a sample that is being considered as a feature of the idiolect being possibly +5/ 5 words away from the "head" word of the window (which is normally in the middle). Data in corpus pertaining to idiolect get sorted into three categories: irrelevant, personal discourse marker(s), and informal vocabulary. Samples at the end of the frame and far from this head word are often deemed superfluous. Superfluous and non superfluous data are then run through different functions to see if given words or phrases are a part of an individual's idiolect.