Кіріспе

Жеке адамның тілдегі айтылу және грамматика үлгілері.

Идиолект – адамның тілді ерекше қолдануы, соның ішінде сөйлеуін қамтиды. Бұл ерекше қолданыс сөздік қорын, грамматиканы және айтылу ерекшеліктерін қамтиды. Бұл диалекттен өзгеше, яғни белгілі бір топ адамдардың ортақ тілдік ерекшеліктерінен айырмашылығы бар. Бұл термин этимологиялық тұрғыдан грек тіліндегі idio префиксімен ("жеке, дербес, ерекше, бөлек") және диалекттен алынған "лект" түбірімен, сондай-ақ ежелгі грек тіліндегі λέγω сөзімен байланысты.

Тіл

Тіл сөйлем құрылыстарынан, сөздерді таңдаудан және стильдік өрнектерден тұрады, ал идиолект – жеке адамның осы элементтерді қолдануын қамтиды. Әр адамның тілі, әлеуметтік-экономикалық жағдайы және географиялық орналасуына байланысты ерекше идиолекті болады. Сот лингвистикасы идиолектілерді психологиялық тұрғыдан талдайды. Тіл ұғымы тілдің қолданылуын, сондай-ақ жеке сөйлеушілер мен тыңдаушылардың қабілеттерін абстрактілі түрде сипаттау үшін қолданылады. Осы көзқарас бойынша, тіл – "өздігінен бірлік емес, идиолекттердің жиынтығы". Тіл білімі мамандары нақты тілдерді ана тілінде сөйлейтін адамдардың айтқан сөздерін зерттеу арқылы талдайды. Бұл, кем дегенде АҚШ-та, тіл білмейтіндер арасында тілдердің тіл қолданушыларының нақты практикасынан тысқары тұратын идеалдық жүйелер екендігі туралы пікірмен қарама-қайшы келеді. АҚШ-та жүргізілген зерттеулер негізінде Нэнси Нидзиелски мен Дэннис Престон америкалық ағылшын тілінде сөйлейтіндер арасында кең таралған тіл идеологиясын сипаттайды. Нидзиелски мен Престонның сөзіне сүйенсек, олардың көптеген қатысушылары стандарттық ағылшынның негізінде жатқан грамматика мен сөздіктің бір "дұрыс" үлгісі бар екеніне және жеке қолдану осы сыртқы жүйеден туындайды деп санайды. Тіл білімі мамандары нақты тілдерді бірегей, жеке идиолекттердің жиынтығы ретінде қарастырғанмен, үлкен тілдік қауымдастықтардың мүшелерінің, тіпті бір тілдің әртүрлі диалектілерін сөйлейтіндердің бір-бірін түсіне алатындығын ескеруі керек. Барлық адамдар тілді шамамен бірдей қағидалар бойынша құрастырады. Бұл жалпыға ортақ грамматиканы іздеуге, сондай-ақ нақты тілдердің мәнін анықтауға бағытталған зерттеулерге әкелді.

Сот лингвистикасы

Сот лингвистикасы мәтіннің стилін сол адамның идиолектісімен салыстыру арқылы адамның белгілі бір мәтінді жазғанын анықтауға бағытталған зерттеулерді қамтиды. Сот лингвисті мәтіннің аталған тұлғаға сәйкес келетінін, оны автор ретінде жоққа шығаратынын немесе салыстыруды шешім қабылдауға жеткіліксіз деп таба алады. 1995 жылы Макс Аппедоль Рафаэль Себастьян Гиллен Висентенің жазу стилін талдау нәтижесінде оны сапатистік қозғалыстың жетекшісі Субкоманданте Маркос екенін анықтады. Мексика үкіметі Субкоманданте Маркосты қауіпті партизан деп есептесе де, Аппедоль үкіметті Гилленнің бейбітшіл екеніне көндірді. Аппедольдің талдауы құқық қорғау органдарында сот лингвистикасын қылмыстық профильдеу үшін қолданудың алғашқы жетістігі деп саналады. 1998 жылы Тед Качински сот лингвистикасы арқылы «Унабомбер» ретінде танылды. ФБР және Бас прокурор Джанет Рено Качинскидің эссесін жариялауға ынталандырды, бұл Качинскидің ағасынан хабар түюіне себеп болды, ол жазу стилін, оның идиолектісін таныды. 1978 жылы төрт адам Карл Бриджвотерді өлтіргені үшін сотталды. Олардың ісіне сол кезде сот лингвистикасының қатысы болған жоқ. Бүгінде сот лингвистикасы көрсеткендей, ер адамдардың бірінен алынған сұхбатта қолданылған идиолекті оның бұрынғы мәлімдемесімен өте ұқсас. Идиолектілер әр адамға тән болғандықтан, сот лингвистикасы осы файлдардың бірі екіншісін пайдаланбастан жасалғанының ықтималдығы өте төмен екенін көрсетеді.

Идиолектілерді корпустармен анықтау

Идиолектілік талдау жеке адам үшін талдауға алынатын деректер мәтіндерден немесе аудио файлдардан тұратын корпустың құрамына байланысты өзгеше болады, себебі жазбаша жұмыс жоспарлау кезінде ойластырылып, сөздері нақтырақ келтіріледі, ал спонтанды сөйлеу бейресми тілге және әңгімелерді толтыру үшін қолданылатын сөздерге ("ммм", "білесіз бе" сияқты) толы болады. Көп көлемді деректерді қамтитын корпус сөздердің жиілігі мен синонимдердің тізімдерін жасауға мүмкіндік береді, әдетте, одан құрылған ең көп қолданылатын он биграмма арқылы. Мұндай жағдайда сөздің қолданылу контексі, әсіресе берілген биграмманың дұрыстығын анықтау кезінде ескеріледі. Сөздің немесе сөз тіркесінің идиолектіге жататыны оның терезенің бас сөзімен салыстырғандағы орналасуы арқылы анықталады. Бұл терезе 7-10 сөзден тұрады, ал идиолектінің ерекшелігі ретінде қарастырылатын үлгі терезенің "бас" сөзінен +5/-5 сөз қашықтықта болуы мүмкін (әдетте ортасында). Идиолектіге қатысты деректер корпуста үш санатқа бөлінеді: маңызсыз, жеке сөздік маркерлер және бейресми сөздік. Фреймнің соңындағы және бас сөзден алыс орналасқан үлгілер көбінесе артық деп есептеледі. Артық және артық емес деректер әртүрлі функциялар арқылы өңделіп, берілген сөздердің немесе сөз тіркестерінің жеке адамның идиолектісінің бөлігі болып табылатынын анықтауға мүмкіндік береді.