Введение
Основной элемент языка – единица речи и письма. Слово – это основной элемент языка, несущий смысл, способный использоваться самостоятельно и являющийся неделимым. Несмотря на то, что носители языка часто интуитивно понимают, что такое слово, среди лингвистов нет единого мнения относительно его определения, и многочисленные попытки найти конкретные критерии этого понятия остаются предметом споров. Предлагались различные подходы, зависящие от теоретической базы и описательного контекста, однако они не приводят к единому определению. Некоторые конкретные определения термина «слово» используются для передачи его различных значений на разных уровнях анализа, например, на основе фонологических, грамматических или орфографических признаков. Другие считают, что это просто условность, используемая в повседневной практике. Понятие «слово» отличается от понятия «морфема», которая является наименьшей значимой единицей языка, даже если она не может употребляться самостоятельно. Это справедливо для английского языка и для большинства языков, использующих алфавиты, происходящие от древнелатинского или греческого алфавитов. В английской орфографии последовательности букв "rock", "god", "write", "with", "the" и "not" рассматриваются как одноморфемные слова, в то время как "rocks", "ungodliness", "typewriter" и "cannot" – это слова, состоящие из двух или более морфем ("rock"+"s", "un"+"god"+"li"+"ness", "type"+"writ"+"er" и "can"+"not").
the unit of speech and writing
A word is a basic element of language that carries meaning, can be used on its own, and is uninterruptible. Despite the fact that language speakers often have an intuitive grasp of what a word is, there is no consensus among linguists on its definition and numerous attempts to find specific criteria of the concept remain controversial. Different standards have been proposed, depending on the theoretical background and descriptive context; these do not converge on a single definition. Some specific definitions of the term "word" are employed to convey its different meanings at different levels of description, for example based on phonological, grammatical or orthographic basis. Others suggest that the concept is simply a convention used in everyday situations. The concept of "word" is distinguished from that of a morpheme, which is the smallest unit of language that has a meaning, even if it cannot stand on its own. This is the case for the English language, and for most languages that are written with alphabets derived from the ancient Latin or Greek alphabets. In English orthography, the letter sequences "rock", "god", "write", "with", "the", and "not" are considered to be single morpheme words, whereas "rocks", "ungodliness", "typewriter", and "cannot" are words composed of two or more morphemes ("rock"+"s", "un"+"god"+"li"+"ness", "type"+"writ"+"er", and "can"+"not").
Определения и значения
С начала изучения лингвистики было предпринято множество попыток определить, что такое слово, используя различные критерии. Словари категоризируют лексикон языка, разделяя его на отдельные формы, называемые леммами. Эти леммы можно рассматривать как отражение представления авторов языка о том, что составляет "слово". Эта письменная форма слова и есть лексема. Наиболее подходящий способ измерения длины слова – подсчет слогов или морфем. Если у слова есть несколько значений или оттенков смысла, это может вызвать путаницу в спорах или обсуждениях.
Фоналогия
Одно из отличительных значений термина «слово» можно определить на фонологических основаниях. Это единица, равная или большая по размеру слога, которую можно выделить по сегментным или просодическим признакам или посредством её взаимодействия с фонологическими правилами. В языке вальматджари, одном из австралийских языков, корни или суффиксы могут состоять всего из одного слога, но фонологическое слово должно содержать не менее двух слогов. Двусложный глагольный корень может принимать нулевой суффикс, например, *luwa ø* ‘бей!’, но односложный корень обязательно требует суффикса, например, *ya nta* ‘иди!’, тем самым соответствуя сегментной структуре слов вальматджари. В диалекте питжантжатжара языка вати, еще одного австралийского языка, слог внутри слова может заканчиваться согласным, но последний слог слова должен заканчиваться гласным. В большинстве языков ударение может служить критерием для определения фонологического слова. В языках с фиксированным ударением можно установить границы слова по его положению. Хотя в языках с фонематическим ударением невозможно предсказать границы слова только по ударению, в каждом слове будет только один слог с основным ударением, что позволяет определить общее количество слов в высказывании. Многие фонологические правила действуют только внутри фонологического слова или конкретно на границах слов. В венгерском языке зубные согласные /d/, /t/, /l/ или /n/ ассимилируются с последующим полугласным /j/, образуя соответствующий палатализованный звук, но только в пределах одного слова. Напротив, правила внешней сандхи действуют на границах слов. Классическим примером этого правила является санскрит, однако начальная мутация согласных в современных кельтских языках или явление связующего *r* в некоторых неротических диалектах английского языка также могут быть использованы для иллюстрации границ слов. Зачастую фонологическое слово не совпадает с нашим интуитивным представлением о слове. Финское сложное слово *pääkaupunki* ‘столица’ фонологически состоит из двух слов (*pää* ‘голова’ и *kaupunki* ‘город’), поскольку оно не соответствует финским моделям гармонии гласных внутри слова. И наоборот, одно фонологическое слово может состоять из нескольких синтаксических элементов, как, например, в английской фразе *I’ll come*, где *I’ll* образует одно фонологическое слово.
Лексемы
Слово можно рассматривать как элемент внутреннего лексикона говорящего; это называется лексемой. Однако это может отличаться от обычного понимания слова, поскольку одна лексема включает в себя все его грамматические формы. Лексема «чайник» относится как к единственному числу «чайник», так и к множественному числу «чайники». Также возникает вопрос о том, в какой степени в лексему следует включать образованные или составные слова, особенно в агглютинативных языках. Например, не вызывает сомнений, что в турецком языке лексема «дом» должна включать именительный падеж единственного числа *ev* и множественного числа *evler*. Однако неясно, следует ли включать также слово *evlerinizden* – «из ваших домов», образованное путем регулярного присоединения суффикса. Существуют также лексемы, такие как «черно-белый» или «сделай сам», которые, хотя и состоят из нескольких слов, тем не менее образуют единое сочетание с фиксированным значением.
Грамматика
Грамматические слова предлагается рассматривать как состоящие из ряда грамматических элементов, которые встречаются совместно (а не в разных частях предложения) в фиксированном порядке и имеют установленное значение. Однако существуют исключения из всех этих критериев. Отдельные грамматические слова имеют фиксированную внутреннюю структуру; при изменении этой структуры меняется и значение слова. В языке дырбал, который допускает использование множества деривационных аффиксов с существительными, существуют двойной суффикс *jarran* и суффикс *gabun*, означающий "другой". С существительным *yibi* их можно сочетать как *yibi jarran gabun* ("ещё две женщины") или *yibi gabun jarran* ("две другие женщины"), но изменение порядка суффиксов также меняет их значение. Носители языка обычно связывают конкретное значение со словом в целом, а не с отдельной морфемой. Например, когда их просят обсудить ложь, они редко акцентируют внимание на значении морфем, таких как *th* или *ness*.
Семантика
Леонард Блумфилд ввёл концепцию "минимальных свободных форм" в 1928 году. Слова рассматриваются как наименьшая значимая единица речи, способная самостоятельно функционировать. Это устанавливает соответствие между фонемами (единицами звука) и лексемами (единицами значения). Однако некоторые слова в письменной форме не являются минимальными свободными формами, так как не имеют смысла сами по себе (например, "the" и "of"). Некоторые семантики выдвинули теорию так называемых семантических примитивов или семантических простых понятий – неопределимых слов, выражающих фундаментальные концепты, которые интуитивно понятны. Согласно этой теории, семантические примитивы служат основой для описания значения других слов и связанных с ними концептуальных денотатов, избегая круговых определений.
Особенности
В минималистической школе теоретического синтаксиса слова (также называемые лексическими элементами в литературе) рассматриваются как «наборы» лингвистических признаков, объединенных в структуру, обладающую формой и значением. Например, слово "koalas" обладает семантическими признаками (обозначает объекты реального мира – коал), категориальными признаками (является существительным), признаками числа (является множественным числом и должно согласовываться с глаголами, местоимениями и указательными словами в своей области), фонологическими признаками (имеет определенное произношение) и т.д.
Орфография
В языках с литературной традицией вопрос о том, что считается одним словом, зависит от орфографии. Разделители слов, как правило, пробелы и знаки препинания, широко используются в современной орфографии языков, использующих алфавитные системы письма, но это относительно недавнее явление в истории письменности. В кодировании символов сегментация слов зависит от того, какие символы определены как разделители слов. В английской орфографии составные выражения могут содержать пробелы. Например, *ice cream* (мороженое), *air raid shelter* (укрытие от воздушного налета) и *get up* (вставать) обычно считаются состоящими из более чем одного слова (поскольку каждый из компонентов является самостоятельной формой, за исключением, возможно, *get*), а также *no one* (никто), но аналогично образованные *someone* (кто-то) и *nobody* (никто) считаются одним словом. Иногда языки, близкие по грамматике, по-разному трактуют один и тот же порядок слов. Например, возвратные глаголы во французском инфинитиве отделены от соответствующей частицы, например, *se laver* («мыться»), в то время как в португальском они разделены дефисом, например, *lavar se*, а в испанском – пишутся слитно, например, *lavarse*. Не все языки чётко разграничивают слова. Мандаринский китайский – это высокоаналитический язык с небольшим количеством флективных аффиксов, что делает ненужной орфографическую делимитацию слов. Однако в мандаринском языке существует множество сложных слов, состоящих из нескольких морфем, а также множество связанных морфем, что затрудняет чёткое определение того, что составляет слово. Японский язык использует орфографические признаки для разграничения слов, такие как переключение между кандзи (символы, заимствованные из китайской письменности) и двумя слоговыми азбуками кана. Это довольно гибкое правило, поскольку значимые слова также могут быть написаны хираганой для стилистического эффекта, хотя при широком использовании обычно добавляются пробелы для сохранения читаемости. Вьетнамская орфография, хотя и использует латинский алфавит, разграничивает односложные морфемы, а не слова.
Границы слов
Задача определения того, что составляет "слово", заключается в установлении того, где заканчивается одно слово и начинается другое, то есть в определении границ слов. Существует несколько способов определить, где следует размещать границы слов в устной речи: гласные звуки внутри одного слова обладают одинаковым качеством, поэтому граница слова, скорее всего, возникает при изменении качества гласного. Тем не менее, не во всех языках существуют такие удобные фонетические правила, и даже в тех, где они есть, встречаются исключения. Орфографические границы: разделители слов, такие как пробелы и знаки препинания, могут использоваться для выделения отдельных слов. Однако это зависит от конкретного языка. В восточноазиатских системах письма символы часто не разделяются. Это характерно для китайской и японской письменности, использующей логографические иероглифы, а также для тайской и лаосской письменности, являющихся абугидами.
Философия
Философы находили в словах объект восхищения, по крайней мере, с V века до нашей эры, со времени возникновения философии языка. Платон анализировал слова с точки зрения их происхождения и составляющих их звуков, придя к выводу о некоторой связи между звуком и значением, хотя слова сильно меняются с течением времени. Джон Локк писал, что употребление слов должно являться "чувственными знаками идей", хотя они выбираются "не на основании какой-либо естественной связи между конкретными артикулируемыми звуками и определенными идеями, ибо тогда среди всех людей был бы только один язык, а посредством произвольного установления, в силу которого слово произвольно становится знаком определенной идеи". Мысль Витгенштейна эволюционировала от понимания слова как репрезентации значения к утверждению, что "значение слова – это его употребление в языке".
Классы
Каждое слово принадлежит к категории, основанной на общих грамматических свойствах. Как правило, лексику языка можно классифицировать на несколько таких групп слов. Общее количество категорий, а также их типы не являются универсальными и варьируются в зависимости от языка. Например, в английском языке существует группа слов, называемых артиклями, таких как the (определенный артикль) или a (неопределенный артикль), которые указывают на определенность или идентифицируемость. Этот класс отсутствует в японском языке, который полагается на контекст для обозначения этого различия. С другой стороны, в японском языке есть класс слов, называемых частицами, которые используются для маркировки именных фраз в соответствии с их грамматической функцией или тематической связью, что в английском языке выражается порядком слов или просодией. Неясно, существуют ли какие-либо категории, кроме междометий, которые были бы универсальными для всех человеческих языков. Основное бинарное деление, повсеместно встречающееся в естественных языках, – это деление на существительные и глаголы. Однако в некоторых языках вакаш и салиш все содержательные слова можно понимать как глагольной природы. В языке люшоцед, относящемся к языкам салиш, все слова со «существительными» значениями могут использоваться предикативно, функционируя как глаголы. Например, слово sbiaw можно понимать как «(есть) койот», а не просто «койот». С другой стороны, в эскимо-алеутских языках все содержательные слова можно анализировать как имена, при этом агентивные существительные выполняют роль, наиболее близкую к глаголам. Наконец, в некоторых австронезийских языках неясно, применимо ли это различие, и все слова лучше всего описывать как междометия, которые могут выполнять роли других категорий. Современная классификация слов по категориям основана на работах Дионисия Фракийского, который в I веке до н.э. выделил восемь категорий древнегреческих слов: существительное, глагол, причастие, артикль, местоимение, предлог, наречие и союз. Позднее латинские авторы, Аполлоний Дискол и Присциан, применили его систему к своему языку; поскольку в латинском языке нет артиклей, они заменили этот класс междометием. Прилагательные («счастливый»), кванторы («немного») и числительные («одиннадцать») не выделялись в отдельные категории в этих классификациях из-за их морфологического сходства с существительными в латинском и древнегреческом языках. Они были признаны отдельными категориями только тогда, когда ученые начали изучать более поздние европейские языки. В индийской грамматической традиции Панини ввел аналогичную фундаментальную классификацию на номинальный (nāma, suP) и вербальный (ākhyāta, tiN) классы, основанную на наборе суффиксов, присоединяемых к слову. Некоторые слова могут вызывать споры, например, сленг в формальных контекстах; неправильные названия, поскольку они не соответствуют своему подразумеваемому значению; или полисемические слова из-за потенциальной путаницы между их различными значениями.
История
В древнегреческой и римской грамматической традиции слово являлось базовой единицей анализа. Изучались различные грамматические формы данной лексемы, однако не предпринималось попыток разложить их на морфемы. Это могло быть обусловлено синтетическим характером этих языков, где внутренняя структура слов может быть сложнее для дешифровки, чем в аналитических языках. Кроме того, отсутствовало понятие о различных видах слов, таких как грамматические или фонологические – слово рассматривалось как единое целое. Слово (dictiō) определялось как минимальная единица высказывания (ōrātiō), выражающая законченную мысль.