Ағылшыншамен салыстырыңыз: абзацты басыңыз — түпнұсқа терезеде ашылады. Абзац астындағы EN түймесі оны мәтін ішінде көрсетеді.
Мазмұны
Кіріспе
Сөзді буынға бөлу – жолдарды бөлу үшін сөздерді бөлу.
Separation of a word into syllables
the division of words to break lines
Буынға бөлу (/s//ɪ/,/l//æ//b//ɪ//f//ɪ/'/k//eɪ//ʃ//ən/) немесе буынға жіктеу (/s//ɪ/,/l//æ//b//ɪ/'/k//eɪ//ʃ//ən/), сондай-ақ дефис қою деп те аталады, – сөзді буынға бөлу, ол айтылған, жазылған немесе қолмен көрсетілген кезде қолданылады.
Syllabification (/s//ɪ/,/l//æ//b//ɪ//f//ɪ/'/k//eɪ//ʃ//ən/) or syllabication (/s//ɪ/,/l//æ//b//ɪ/'/k//eɪ//ʃ//ən/), also known as hyphenation, is the separation of a word into syllables, whether spoken, written or signed.
Шолу
Жазбадағы буынға бөлу әдетте ағылшын орфографиясы қолданылғанда (мысалы, syl la ble) және Халықаралық фонетикалық әліпбиде (мысалы, ) дефиспен белгіленеді, ал дыбыстағы нақты буынды жазбаға көшіруде нүкте қолданылады. Көрнекі мақсаттар үшін типографтар нүктелі дефис (Unicode U+00B7 символы, мысалы, syl·la·ble), арнайы мақсаттағы «буынға бөлу нүктесі» (U+2027, мысалы, syl‧la‧ble) немесе бос орын (мысалы, syl la ble) пайдалана алады. Жолдың соңында сөз, егер ол жолға сыймаса және оны келесі жолға жылдырса, бірінші жолды қалғандарынан әлдеқайда қысқа қылып жасайтын болса, конвенция бойынша «буын» деп аталатын бөліктерге бөлінеді. Бұл өте ұзын сөздермен және газеттердегі тар бағандармен ерекше мәселе тудыруы мүмкін. Сөздік өңдеу процесі автоматты түрде бетке түсіруді қамтамасыз етеді, сондықтан қысқа сөздерді буынға бөлу көбінесе қажет болмайды. Кейбір тілдерде сөйленетін буын жазудағы буынға бөлудің негізі болып табылады. Дегенмен, қазіргі ағылшын тілінде дыбыстар мен әріптердің нашар сәйкестігіне байланысты, ағылшын тіліндегі жазбадағы буынға бөлу көбінесе фонетикалық емес, этимологиялық немесе морфологиялық принциптерге негізделген. Мысалы, «оқу» сөзін тірі тілдің дұрыс буынға бөлу ережелеріне сәйкес «оқу» деп жазу мүмкін емес. Жолдың соңында тек «lear» дегенді көру оқырманды сөзді дұрыс емес айтуға итермелеуі мүмкін, себебі «ea» диграфының көптеген әртүрлі мәндері бар. Ағылшын орфографиясының тарихы мұндай құбылыстарды түсіндіреді. Сондықтан ағылшын тіліндегі жазбадағы буынға бөлу лингвистикалық тұрғыдан алғанда фонологиялық (морфологиялық емес) бірлік ұғымына сәйкес келмейтін «буын» ұғымымен айналысады. Нәтижесінде, тіпті ағылшын тілінің ана тілінде сөйлейтін көптеген адамдар сөздікке немесе мәтіндік процессорға жүгінбей, белгіленген ережелерге сәйкес сөздерді буынға бөле алмайды. Мектептерде көбінесе сөздікке қараудан басқа кеңес берілмейді. Сонымен қатар, британдық және американдық буынға бөлу арасында, тіпті бір ағылшын тіліндегі сөздіктер арасында да айырмашылықтар бар. Фин, итальян, португал, жапон (Ромадзи), корей (романдық әліпбимен жазылған) және басқа да дерлік фонемалық принцип бойынша жазылатын тілдерде авторлар кез келген қолданыстағы немесе жаңадан құрылған сөзді тек жалпы ережелерді қолдана отырып дұрыс буынға бөле алады. Финляндияда балаларға әр сөзді дұрыс дефиспен жазуға үйретеді, содан кейін дефиссіз жазуға көшеді.
The written separation into syllables is usually marked by a hyphen when using English orthography (e. g., syl la ble) and with a period when transcribing the actually spoken syllables in the International Phonetic Alphabet (e. g., ). For presentation purposes, typographers may use an interpunct (Unicode character U+00B7, e. g., syl·la·ble), a special purpose "hyphenation point" (U+2027, e. g., syl‧la‧ble), or a space (e. g., syl la ble). At the end of a line, a word is separated in writing into parts, conventionally called "syllables", if it does not fit the line and if moving it to the next line would make the first line much shorter than the others. This can be a particular problem with very long words, and with narrow columns in newspapers. Word processing has automated the process of justification, making syllabification of shorter words often unnecessary. In some languages, the spoken syllables are also the basis of syllabification in writing. However, possibly due to the weak correspondence between sounds and letters in the spelling of modern English, written syllabification in English is based mostly on etymological or morphological, instead of phonetic, principles. For example, it is not possible to syllabify "learning" as lear ning according to the correct syllabification of the living language. Seeing only lear at the end of a line might mislead the reader into pronouncing the word incorrectly, as the digraph ea can hold many different values. The history of English orthography accounts for such phenomena. English written syllabification therefore deals with a concept of "syllable" that does not correspond to the linguistic concept of a phonological (as opposed to morphological) unit. As a result, even most native English speakers are unable to syllabify words according to established rules without consulting a dictionary or using a word processor. Schools usually do not provide much more advice on the topic than to consult a dictionary. In addition, there are differences between British and US syllabification and even between dictionaries of the same English variety. In Finnish, Italian, Portuguese, Japanese (Romaji), Korean (Romanized) and other nearly phonemically spelled languages, writers can in principle correctly syllabify any existing or newly created word using only general rules. In Finland, children are first taught to hyphenate every word until they produce the correct syllabification reliably, after which the hyphens can be omitted.
Алгоритм
Гифендеу алгоритмі – компьютерлік бағдарламада іске асыру үшін жазылған, сөзді гифенмен екі жолға бөлуге болатын нүктелерді анықтайтын ережелер жиынтығы. Мысалы, гифендеу алгоритмі "импичмент" сөзін "импич-мент" немесе "им-пичмент" деп бөлуге рұқсат етуі мүмкін, бірақ "импе-ачмент" деп бөлуге жол бермейді. Сөзді бөлу ережелерінің күрделілігінің себебі – ағылшын тілінің әртүрлі диалектілері гифендеуде өзгешеліктерге ие: американдық ағылшын тілі көбінесе дыбысталуға сүйенеді, ал британдық ағылшын тілі сөздің түбіріне, содан кейін дыбысталуға назар аударады. Бұған қоса, көптеген ерекше жағдайлар бар, бұл мәселені одан әрі усложнит. Кейбір жалпы ережелерді майор Киаридің "Гифендеу туралы – педантизмнің анархиясы" еңбегінде табуға болады. Гифендеуге қатысты алгоритмдік тәсілдердің ішінде TeX жинақтау жүйесінде қолданылатын тәсіл кеңінен таралған. Ол Дональд Кнуттың "Компьютерлер және жинақтау" атты алғашқы екі томында және Франклин Марк Лянның диссертациясында толыққанды сипатталған. Лянның жұмысының мақсаты – алгоритмді мүмкіндігінше дәл ету және ерекше жағдайларды азайту болды. TeX-тің американдық ағылшын тіліндегі бастапқы гифендеу үлгілеріндегі ерекше жағдайлар тізімінде бар болғаны 14 сөз бар.
A hyphenation algorithm is a set of rules, especially one codified for implementation in a computer program, that decides at which points a word can be broken over two lines with a hyphen. For example, a hyphenation algorithm might decide that impeachment can be broken as impeach ment or im peachment but not impe achment. One of the reasons for the complexity of the rules of word breaking is that different dialects of English tend to differ on hyphenation: American English tends to work on sound, but British English tends to look to the origins of the word and then to sound. There are also a large number of exceptions, which further complicates matters. Some rules of thumb can be found in the Major Keary's "On Hyphenation – Anarchy of Pedantry." Among the algorithmic approaches to hyphenation, the one implemented in the TeX typesetting system is widely used. It is thoroughly documented in the first two volumes of Computers and Typesetting by Donald Knuth and in Franklin Mark Liang's dissertation. The aim of Liang's work was to get the algorithm as accurate as possible and to keep exceptions to a minimum. In TeX's original hyphenation patterns for American English, the exception list contains only 14 words.