Кіріспе
Тілдің негізгі элементі – сөйлеу мен жазудың бірлігі. Сөз – тілдің мағынаны білдіретін, өздігінен қолданыла алатын және бөлінбейтін негізгі элементі. Тілді білушілер сөздің не екенін көбінесе түсінеді, бірақ тіл мамандары арасында оның анықтамасы бойынша бірлік жоқ және осы ұғымның нақты критерийлерін табуға жасалған көптеген әрекеттер әлі де даулы. Теориялық негіздерге және сипаттамалық контекстке байланысты түрлі стандарттар ұсынылған, бірақ олардың ешқайсысы жалғыз анықтамаға келмейді. "Сөз" терминінің нақты анықтамалары әртүрлі деңгейде, мысалы, фонетикалық, грамматикалық немесе орфографиялық негізде оның әртүрлі мағыналарын түсіндіру үшін қолданылады. Ал кейбіреулер бұл ұғымды күнделікті жағдайда қолданылатын конвенция деп санайды. "Сөз" ұғымы морфемадан өзгеше, морфема – мағынасы бар, бірақ өздігінен қолданыла алмайтын тілдің ең кішкентай бірлігі. Бұл ағылшын тіліне және ежелгі латын немесе грек әліпбилерінен туындаған әліпбилермен жазылатын көптеген тілдерге қатысты. Ағылшын тілінде "rock", "god", "write", "with", "the", "not" әріптерінің тізбегі бір морфемалық сөздер саналады, ал "rocks", "ungodliness", "typewriter" және "cannot" сөздері екі немесе одан көп морфемадан тұрады ("rock"+"s", "un"+"god"+"li"+"ness", "type"+"writ"+"er", және "can"+"not").
the unit of speech and writing
A word is a basic element of language that carries meaning, can be used on its own, and is uninterruptible. Despite the fact that language speakers often have an intuitive grasp of what a word is, there is no consensus among linguists on its definition and numerous attempts to find specific criteria of the concept remain controversial. Different standards have been proposed, depending on the theoretical background and descriptive context; these do not converge on a single definition. Some specific definitions of the term "word" are employed to convey its different meanings at different levels of description, for example based on phonological, grammatical or orthographic basis. Others suggest that the concept is simply a convention used in everyday situations. The concept of "word" is distinguished from that of a morpheme, which is the smallest unit of language that has a meaning, even if it cannot stand on its own. This is the case for the English language, and for most languages that are written with alphabets derived from the ancient Latin or Greek alphabets. In English orthography, the letter sequences "rock", "god", "write", "with", "the", and "not" are considered to be single morpheme words, whereas "rocks", "ungodliness", "typewriter", and "cannot" are words composed of two or more morphemes ("rock"+"s", "un"+"god"+"li"+"ness", "type"+"writ"+"er", and "can"+"not").
Анықтамалар мен мағыналар
Тіл білімі зерттеулерінің басталысынан бері сөзді қалай анықтауға болады дегенге қатысты көптеген әртүрлі критерийлер ұсынылып келді. Сөздіктер тілдің лексикалық қорын жеке тізімделген түйіндемелерге (леммаларға) бөліп көрсетеді. Бұл сол тілдің авторларының пікірінше, "сөз" дегеніміз не екенін көрсетеді. Сөздің осы жазбаша түрі лексема деп аталады. Сөздің ұзындығын өлшеудің ең тиімді жолы – оның буын немесе морфемаларын санау. Егер сөздің бірнеше анықтамасы немесе мағынасы болса, пікірсайыста немесе талқылауда жаңсақтық тудыруы мүмкін.
Фоналогия
"Сөз" терминінің бір ерекше мағынасын фонологиялық негізде анықтауға болады. Бұл – сегменттік немесе прозодикалық белгілерге немесе фонологиялық ережелермен өзара әрекеттесуіне сүйенетін, бір буыннан кем емес, тіл бірлігі. Валматжари тілінде, австралиялық тілдердің бірінде, түбірлер немесе жұрнақтар бір буыннан тұруы мүмкін, бірақ фонологиялық сөз кемінде екі буыннан құралуы керек. Екі буынды етістік түбірі нөлдік жұрнақ алады, мысалы, luwa ø 'соқ! ', ал бір буынды түбірге жұрнақ қосылуы тиіс, мысалы, ya nta 'кел! ', осылайша Валматжари сөздерінің сегменттік үлгісіне сәйкес келеді. Австралиядан тағы бір тіл – вати тілінің питжантжатара диалектісінде сөздің ортаңғы буыны дауыссызға аяқталуы мүмкін, бірақ сөздің соңғы буыны әрқашан дауыстыға аяқталуы керек. Көптеген тілдерде стресс фонологиялық сөзді анықтау критерийі болып табылады. Белгілі бір стрессі бар тілдерде стресстің орналасуынан сөз шекараларын анықтауға болады. Фонемалық стрессі бар тілдерде стресстің өзінен сөз шекараларын болжау мүмкін болмаса да, әр сөздің тек бір басты стресі болады, бұл сөйлемдегі сөздердің жалпы санын анықтауға мүмкіндік береді. Көптеген фонологиялық ережелер тек фонологиялық сөз ішінде немесе сөз шекаралары арқылы жұмыс істейді. Венгр тілінде тіс дыбыстары /d/, /t/, /l/ немесе /n/ келесі жартылай дауысты /j/ дыбысына ассимиляцияланып, сәйкес келетін таңдайырық дыбысты тудырады, бірақ бұл тек бір сөз ішінде ғана болады. Керісінше, сыртқы санди ережелері сөз шекараларынан тыс әрекет етеді. Бұл ережеге классикалық мысал санскрит тілінен келген; алайда, қазіргі кельт тілдеріндегі бастапқы дауыс өзгерісі немесе кейбір ротикалық емес ағылшын диалектілеріндегі байланыстырғыш 'r' құбылысы да сөз шекараларын көрсету үшін қолданылуы мүмкін. Көбінесе фонологиялық сөз біздің сөз туралы интуитивті түсінігімізге сәйкес келмейді. Фин тіліндегі pääkaupunki 'астана' сөзі фонологиялық тұрғыдан екі сөзден (pää 'бас' және kaupunki 'қала') тұрады, өйткені ол фин тіліндегі дауыстылар үйлесімділігінің үлгілеріне сәйкес келмейді. Керісінше, бір фонологиялық сөз бірнеше синтаксистік элементтерден құралуы мүмкін, мысалы, ағылшын тіліндегі I'll come фразасында, I'll бір фонологиялық сөзді құрайды.
Лексемалар
Сөзді сөйлеушінің ішкі лексикасындағы бірлік ретінде қарастыруға болады; мұны лексема деп атайды. Дегенмен, бұл күнделікті тілдегі "сөз" ұғымынан өзгеше болуы мүмкін, себебі бір лексема барлық түйірленген формаларды қамтиды. "Чайқұмыр" лексемасы жекеше "чайқұмыр" және көпше "чайқұмырлар" формаларын білдіреді. Сондай-ақ, лексемаға, әсіресе жалғамалы тілдерде, түйірленген немесе күрделі сөздерді қаншалықты қосу керектігі туралы мәселе туындайды. Мысалы, түрік тілінде "үй" лексемасы жалғыз сан "ev" және көп сан "evler" сөздерін қамтуы керек екендігіне күмән жоқ. Бірақ, оған "evlerinizden" ("сіздің үйлеріңізден") сөзі де кіруі керек пе, жоқ па, бұл әлі анық емес, ол реттелген жұрнақтар арқылы жасалады. Сонымен қатар, "қара және ақ" немесе "өз қолымен жасау" сияқты лексемалар бар, олар бірнеше сөзден тұрса да, белгілі бір мағынаны білдіретін бір тіркес болып табылады.
Грамматика
Грамматикалық сөздер белгілі бір ретпен бірге келетін (сөйлем ішінде бөлек жерлерде емес) және нақты бір мағынаны білдіретін бірнеше грамматикалық элементтерден құралған болады. Дегенмен, осы шарттардың барлығына да ерекшеліктер бар. Жеке грамматикалық сөздердің ішкі құрылымы тұрақты; егер құрылымы өшкенде, сөздің мағынасы да өзгереді. Дирбал тілінде зат есімдермен көптеген туынды жұрнақтар қолданылады, онда "басқа" деген мағынаны білдіретін екілік жұрнақ – жарран, ал габун жұрнағы да солай. Иби деген зат есіммен оларды иби жарран габун ("басқа екі әйел") немесе иби габун жарран ("екі басқа әйел") деп орналастыруға болады, бірақ жұрнақтардың ретін өзгерту олардың мағынасын да өзгертеді. Тілдес адамдар әдетте сөзбен нақты бір мағынаны байланыстырады, жеке морфемамен емес. Мысалы, жалған туралы сөйлеуді сұрағанда, олар th немесе ness сияқты морфемалардың мағынасына сирек көңіл бөледі.
Семантика
Леонард Блумфилд 1928 жылы "Минималды еркін формалар" деген ұғымды енгізді. Сөздер – өздігінен қолданыла алатын ең кішкентай мағыналы тіл бірлігі деп есептеледі. Бұл фонемаларды (дыбыс бірліктерін) лексемаларға (мағына бірліктерін) қатыстырады. Дегенмен, жазбаша кейбір сөздер өздерінің жеке мағынасы болмағандықтан минималды еркін формалар болып табылмайды (мысалы, "және" мен "де"). Кейбір семантиктер "семантикалық примитивтер" немесе "семантикалық бастауыштар" деп аталатын теория ұсынды, бұл – негізгі түсініктерді білдіретін, анықталмайтын, бірақ интуитивті түрде түсінікті сөздер. Осы теорияға сәйкес, семантикалық бастауыштар басқа сөздердің мағынасын және олармен байланысты тұжырымдамалық мағынасын дөңгелекке түсірмей сипаттауға негіз болады.
Ерекшеліктері
Теориялық синтаксистің минималистік мектебінде сөздер (әдебиетте лексикалық элементтер деп те аталады) форма мен мағынасы бар құрылымға біріктірілген тілдік ерекшеліктердің "жинамы" ретінде қарастырылады. Мысалы, "коалалар" сөзінің семантикалық ерекшеліктері (ол нақты дүниедегі коалалар сияқты объектілерді білдіреді), категориялық ерекшеліктері (ол есімдік), сандық ерекшеліктері (ол көпше түрде және өзінің саласындағы етістіктермен, есімдіктермен және көрсеткіш есімдермен сәйкес болуы керек), фонологиялық ерекшеліктері (ол белгілі бір тәсілмен айтылады) және тағы да басқалары бар.
Орфографиялық
Әдеби дәстүрі бар тілдерде бір сөзді не деп санау мәселесі орфографияға байланысты. Сөздерді бөліп көрсететін белгілер, әдетте бос орындар мен тыныс белгілері, әліпбилік жазуды қолданатын тілдердің қазіргі орфографиясында кең таралған, бірақ бұл жазу тарихында салыстырмалы түрде жаңа құбылыс. Таңбалық кодтауда сөзді бөлу, сөзді бөлуші ретінде таңбалардың қалай анықталғанына байланысты. Ағылшын тіліндегі орфографияда күрделі тіркестерде бос орындар кездесуі мүмкін. Мысалы, ice cream (мұзжұмсақ), air raid shelter (ауа шабуылынан қорғаныш) және get up (ояну) әдетте бірнеше сөзден тұрады деп есептеледі (әр компоненті еркін қолданылатын формалар болғандықтан, get-тің өзінен басқа), ал no one (ешкім) бір сөз болып саналмайды, бірақ осыған ұқсас құрастырылған someone (біреу) және nobody (ешкім) бір сөз ретінде қарастырылады. Кейде грамматикалық жағынан жақын тілдер бір сөздердің ретін әртүрлі түсінуі мүмкін. Мысалы, француз тіліндегі инфинитивтегі рефлексивті етістіктер өздерінің бөлшектерінен бөлек жазылады, мысалы, se laver ("өзін жуу"), ал португал тілінде олар дефиспен біріктіріледі, мысалы, lavar se, ал испан тілінде біріктіріліп жазылады, мысалы, lavarse. Барлық тілдерде сөздер нақты шеберілмейді. Мандарин тілі – жоғары аналитикалық тіл, онда инфлекциялық жұрнақтар аз, сондықтан сөздерді орфографиялық түрде бөлудің қажеті шамалы. Дегенмен, мандарин тілінде көптеген көп морфемалы қосылыстар бар, сондай-ақ сөзді не құрайтынын анықтауды қиындататын байланған морфемалар да жеткілікті. Жапон тілінде сөздерді бөлу үшін орфографиялық белгілер қолданылады, мысалы, кандзи (қытай жазуынан алынған таңбалар) мен екі кана буын жазуы арасындағы ауысу. Бұл ереже шартты, себебі мазмұнды сөздерді әсер ету үшін хираганамен де жазуға болады, бірақ мұндай жағдайда оқылмау үшін бос орындар қосылады. Вьетнам тіліндегі орфография латын әліпбиін қолданғанымен, сөздерді емес, бір буынды морфемаларды бөліп көрсетеді.
Сөздердің шекарасы
"Сөз" дегенді анықтау міндеті бір сөздің қалай аяқталып, екінші сөз қалай басталатынын анықтауды қамтиды, яғни сөз шекараларын табу. Ауызша тілде сөз шекараларын қайда белгілеуге болатынын анықтаудың бірнеше тәсілі бар: белгілі бір сөз ішіндегі дауысты дыбыстардың сапасы бірдей болады, сондықтан дауысты дыбыс сапасы өзгергенде сөз шекарасы болуы мүмкін. Дегенмен, барлық тілде мұндай қолайлы фонетикалық ережелер болмайды, тіпті олар бар болған жағдайда да кейбір ерекшеліктер кездеседі. Орфографиялық шекаралар: Сөздерді бөліп тұратын бос орындар мен тыныс белгілері жеке сөздерді ажырату үшін қолданылуы мүмкін. Бірақ бұл нақты бір тілге байланысты. Шығыс Азия жазу жүйелерінде әріптер көбінесе бөлек жазылмайды. Мұндай жағдай қытай және жапон жазуларында (логографиялық әріптерді қолданады), сондай-ақ тай және лаос тілдерінде (абугидалар) де кездеседі.
Философия
Философтар сөздерді кемінде б.з.д. 5 ғасырдан бері, тіл философиясының негізі қаланғаннан бастап, қызығушылық тудыратын нысандар деп санады. Платон сөздерді олардың пайда болуы және құрамындағы дыбыстар тұрғысынан талдап, уақыт өте келе сөздер көп өзгерсе де, дыбыс пен мағына арасында белгілі бір байланыс бар деген қорытындыға келді. Джон Локк сөздерді қолдану "идеялардың сезімдік белгілері болуы керек" деп жазды, бірақ олар "нақты дыбыстар мен нақты идеялар арасындағы табиғи байланысқа байланысты таңдалмайды, себебі онда барлық адамдарда бір тіл болар еді; бірақ ерікті түрде белгілену арқылы, осындай сөз осындай идеяның белгісі болып табылады". Витгенштейннің ойлары сөздің мағынаны бейнелеуінен "сөздің мағынасы – тілдегі қолданылуы" дегенге өтті.
Сыныптар
Әр сөз ортақ грамматикалық қасиеттерге негізделген санатқа жатады. Әдетте, тілдің сөздігі бірнеше осындай сөз топтарына жіктелуі мүмкін. Санаттардың жалпы саны, сондай-ақ олардың түрлері әмбебап емес және тілдер арасында әртүрлі. Мысалы, ағылшын тілінде «the» (белгілі артикль) немесе «a» (белгісіз артикль) сияқты артикльдер тобы бар, олар анықтығын немесе тану мүмкіндігін көрсетеді. Бұл санат жапон тілінде жоқ, ол осы айырмашылықты көрсету үшін контекстке сенеді. Ал жапон тілінде грамматикалық функциясы немесе тақырыптық байланысына сәйкес есімдік фразаларды белгілейтін бөлшектер класы бар, ал ағылшын тілінде бұл сөздердің ретімен немесе әуенмен көрсетіледі. Интеръекциядан басқа қандай да бір санаттардың адам тілінің әмбебап бөлігі болып табылатыны белгісіз. Табиғи тілдерде кең таралған негізгі екі бөлім – есімдер мен етістіктер. Дегенмен, кейбір вакашан және салиш тілдерінде барлық мазмұндық сөздер лексикалық сипатта түсіндірілуі мүмкін. Салиш тіліндегі лушутсид тілінде «атына ұқсас» мағынасы бар барлық сөздер предикативті түрде қолданылуы мүмкін, яғни олар етістік сияқты жұмыс істейді. Мысалы, «sbiaw» сөзін жай ғана «койот» емес, «койот болып табылады» деп түсінуге болады. Ал эскимо-алеут тілдерінде барлық мазмұндық сөздер номиналды деп талдауға болады, ал агенттік есімдер етістіктерге ең жақын рөл атқарады. Сонымен қатар, кейбір австронезиялық тілдерде бұл айырмашылықтың қолданылуы белгісіз және барлық сөздерді басқа санаттардың рөлін атқаратын интеръекциялар ретінде сипаттауға болады. Сөздерді санаттарға бөлудің қазіргі классификациясы б.з.б. 1 ғасырда Дионисий Фракия жасаған жұмыстарға негізделген, ол ежелгі грек сөздерінің сегіз санатын бөліп көрсетті: зат есім, етістік, қатысу, артикль, есімдік, сөз тіркесі, үстеу және жалғау. Кейіннен латын авторлары Аполлоний Дискол мен Присциан оның жүйесін өз тілдеріне қолданды; латын тілінде артикльдер болмағандықтан, олар осы санатты интеръекциямен алмастырды. Сипаттауыштар («құбаң»), сандық белгілер («азырақ») және сандар («он бір») латын және ежелгі грек тілдеріндегі есімдермен морфологиялық ұқсастығы болғандықтан осы классификацияларда бөлек қарастырылмады. Олар ғалымдар кейінгі еуропа тілдерін зерттей бастаған кезде ғана жеке санаттар ретінде танылды. Үнді грамматикалық дәстүрінде Панини сөздің алған жұрнақтарына байланысты атаулы (nāma, suP) және етістік (ākhyāta, tiN) кластарына ұқсас негізгі жіктемені енгізді. Кейбір сөздердің жіктелуі даулы болуы мүмкін, мысалы, ресми контексте сленг, дұрыс емес атаулар, өйткені олар білдіретін нәрсені білдірмейді, немесе полисемиялық сөздер, олардың әртүрлі мағыналары арасында шатасу тудыруы мүмкін.
Тарих
Ежелгі грек және римдік грамматикалық дәстүрде сөз талдаудың негізгі бірлігі саналды. Белгілі бір лексеманың әртүрлі грамматикалық түрлері зерттелді, бірақ оларды морфемаларға жіктеуге ұмтылыс болған жоқ. Мүмкін, бұл осы тілдердің синтетикалық сипатымен байланысты болды, онда сөздердің ішкі құрылымын талдау тілдеріне қарағанда анықтау қиын болды. Грамматикалық немесе фонеологиялық сияқты сөздердің түрлері туралы ұғым да болмады – сөз біртұтас құрылым деп есептелді. Сөз (dictiō) – толыққанды ойды білдіретін сөйлемнің (ōrātiō) ең кішкентай бірлігі ретінде анықталды.