Введение

Индивидуальные особенности произношения и грамматики языка.

Идиолект – это уникальное использование языка конкретным человеком, включая его речь. Это уникальное использование охватывает словарный запас, грамматику и произношение. Он отличается от диалекта, представляющего собой общий набор языковых черт, свойственных группе людей. Термин этимологически связан с греческим префиксом *idio* (означающим "собственный, личный, частный, своеобразный, отдельный, отличный") и *lect*, выделенным из понятия "диалект" и восходящим к древнегреческому слову λέγω.

Язык

Язык состоит из синтаксических конструкций, выбора слов и стилистических особенностей, а идиолект представляет собой индивидуальное использование этих элементов. Каждый человек обладает уникальным идиолектом, формирующимся под влиянием его языка, социально-экономического положения и географического местоположения. Судебная лингвистика психологически анализирует идиолекты. Понятие языка используется как абстрактное описание языковой практики и способностей отдельных говорящих и слушающих. Согласно этой точке зрения, язык – это «совокупность идиолектов, а не самостоятельная сущность». Лингвисты изучают конкретные языки, исследуя высказывания носителей языка. Это противопоставляется распространенному среди нелингвистов, особенно в Соединенных Штатах, мнению о том, что языки как идеальные системы существуют вне реального языкового опыта их пользователей. На основе исследований, проведенных в США, Нэнси Нидзиелски и Деннис Престон описывают языковую идеологию, характерную для многих носителей американского английского языка. По мнению Нидзиелски и Престона, многие их испытуемые полагают, что существует единая «нормативная» модель грамматики и лексики, лежащая в основе литературного английского языка, и что индивидуальное языковое поведение проистекает из этой внешней системы. Лингвисты, рассматривающие отдельные языки как композицию уникальных, индивидуальных идиолектов, тем не менее должны учитывать, что члены крупных речевых сообществ и даже носители различных диалектов одного языка способны понимать друг друга. По-видимому, все люди производят язык по сути одинаковым образом. Это привело к поискам универсальной грамматики, а также к попыткам более четко определить природу конкретных языков.

Судебная лингвистика

Судебная лингвистика включает в себя попытки установить, был ли текст создан конкретным человеком, путем сравнения стиля текста с идиолектом этого человека. Судебный лингвист может прийти к выводу о соответствии текста личности автора, исключить эту личность из числа авторов или признать сравнение неубедительным. В 1995 году Макс Аппедоль, опираясь в том числе на анализ стиля письма Рафаэля Себастьяна Гийена Висенте, идентифицировал его как Субкоманданте Маркоса, лидера движения сапатистов. Несмотря на то, что мексиканское правительство считало Субкоманданте Маркоса опасным партизаном, Аппедоль убедил правительство в пацифистских взглядах Гийена. Анализ Аппедоля считается одним из первых успешных примеров применения судебной лингвистики к криминальному профилированию в правоохранительных органах. В 1998 году Тед Качински был опознан как "Унабомбер" с использованием методов судебной лингвистики. ФБР и генеральный прокурор Джанет Рено настояли на публикации эссе Качинского, что привело к тому, что брат Качинского узнал стиль письма, его идиолект, и сообщил об этом властям. В 1978 году четверо мужчин были признаны виновными в убийстве Карла Бриджуотера. В то время судебная лингвистика в их деле не применялась. Сегодня анализ с использованием судебной лингвистики показывает, что идиолект, использованный в ходе допроса одного из этих мужчин, был очень похож на его письменные показания. Поскольку идиолекты уникальны для каждого человека, судебная лингвистика позволяет предположить, что крайне маловероятно, чтобы один из этих документов был создан без использования другого.

Обнаружение идиолекта с корпусами

Идиолектологический анализ различается для конкретного человека в зависимости от того, получены ли анализируемые данные из корпуса, состоящего исключительно из текстов или аудиозаписей, поскольку письменные работы более обдуманны в плане планирования и точны в формулировках, чем спонтанная речь, изобилующая неформальным языком и речевыми заполнителями, например, "эмм" и "ну, знаете". Корпуса с большим объемом данных позволяют генерировать списки частоты слов и синонимов, как правило, на основе десяти наиболее часто встречающихся биграмм. В такой ситуации учитывается контекст употребления слова, особенно при определении валидности данной биграммы. Относится ли слово или фраза к идиолекту, определяется положением слова относительно ключевого слова окна, его границы. Размер этого окна обычно составляет 7-10 слов, при этом образец, рассматриваемый как характеристика идиолекта, может находиться на расстоянии до +5/5 слов от ключевого слова окна (обычно расположенного в центре). Данные корпуса, относящиеся к идиолекту, классифицируются на три категории: нерелевантные, личные дискурсивные маркеры и неформальная лексика. Образцы, находящиеся в конце фрагмента и далеко от ключевого слова, часто считаются избыточными. Избыточные и не избыточные данные затем обрабатываются различными функциями для определения, являются ли конкретные слова или фразы частью идиолекта человека.