Кіріспе

Сөзді буынға бөлу – жолдарды бөлу үшін сөздерді бөлу.

Буынға бөлу (/s//ɪ/,/l//æ//b//ɪ//f//ɪ/'/k//eɪ//ʃ//ən/) немесе буынға жіктеу (/s//ɪ/,/l//æ//b//ɪ/'/k//eɪ//ʃ//ən/), сондай-ақ дефис қою деп те аталады, – сөзді буынға бөлу, ол айтылған, жазылған немесе қолмен көрсетілген кезде қолданылады.

Шолу

Жазбадағы буынға бөлу әдетте ағылшын орфографиясы қолданылғанда (мысалы, syl la ble) және Халықаралық фонетикалық әліпбиде (мысалы, ) дефиспен белгіленеді, ал дыбыстағы нақты буынды жазбаға көшіруде нүкте қолданылады. Көрнекі мақсаттар үшін типографтар нүктелі дефис (Unicode U+00B7 символы, мысалы, syl·la·ble), арнайы мақсаттағы «буынға бөлу нүктесі» (U+2027, мысалы, syl‧la‧ble) немесе бос орын (мысалы, syl la ble) пайдалана алады. Жолдың соңында сөз, егер ол жолға сыймаса және оны келесі жолға жылдырса, бірінші жолды қалғандарынан әлдеқайда қысқа қылып жасайтын болса, конвенция бойынша «буын» деп аталатын бөліктерге бөлінеді. Бұл өте ұзын сөздермен және газеттердегі тар бағандармен ерекше мәселе тудыруы мүмкін. Сөздік өңдеу процесі автоматты түрде бетке түсіруді қамтамасыз етеді, сондықтан қысқа сөздерді буынға бөлу көбінесе қажет болмайды. Кейбір тілдерде сөйленетін буын жазудағы буынға бөлудің негізі болып табылады. Дегенмен, қазіргі ағылшын тілінде дыбыстар мен әріптердің нашар сәйкестігіне байланысты, ағылшын тіліндегі жазбадағы буынға бөлу көбінесе фонетикалық емес, этимологиялық немесе морфологиялық принциптерге негізделген. Мысалы, «оқу» сөзін тірі тілдің дұрыс буынға бөлу ережелеріне сәйкес «оқу» деп жазу мүмкін емес. Жолдың соңында тек «lear» дегенді көру оқырманды сөзді дұрыс емес айтуға итермелеуі мүмкін, себебі «ea» диграфының көптеген әртүрлі мәндері бар. Ағылшын орфографиясының тарихы мұндай құбылыстарды түсіндіреді. Сондықтан ағылшын тіліндегі жазбадағы буынға бөлу лингвистикалық тұрғыдан алғанда фонологиялық (морфологиялық емес) бірлік ұғымына сәйкес келмейтін «буын» ұғымымен айналысады. Нәтижесінде, тіпті ағылшын тілінің ана тілінде сөйлейтін көптеген адамдар сөздікке немесе мәтіндік процессорға жүгінбей, белгіленген ережелерге сәйкес сөздерді буынға бөле алмайды. Мектептерде көбінесе сөздікке қараудан басқа кеңес берілмейді. Сонымен қатар, британдық және американдық буынға бөлу арасында, тіпті бір ағылшын тіліндегі сөздіктер арасында да айырмашылықтар бар. Фин, итальян, португал, жапон (Ромадзи), корей (романдық әліпбимен жазылған) және басқа да дерлік фонемалық принцип бойынша жазылатын тілдерде авторлар кез келген қолданыстағы немесе жаңадан құрылған сөзді тек жалпы ережелерді қолдана отырып дұрыс буынға бөле алады. Финляндияда балаларға әр сөзді дұрыс дефиспен жазуға үйретеді, содан кейін дефиссіз жазуға көшеді.

Алгоритм

Гифендеу алгоритмі – компьютерлік бағдарламада іске асыру үшін жазылған, сөзді гифенмен екі жолға бөлуге болатын нүктелерді анықтайтын ережелер жиынтығы. Мысалы, гифендеу алгоритмі "импичмент" сөзін "импич-мент" немесе "им-пичмент" деп бөлуге рұқсат етуі мүмкін, бірақ "импе-ачмент" деп бөлуге жол бермейді. Сөзді бөлу ережелерінің күрделілігінің себебі – ағылшын тілінің әртүрлі диалектілері гифендеуде өзгешеліктерге ие: американдық ағылшын тілі көбінесе дыбысталуға сүйенеді, ал британдық ағылшын тілі сөздің түбіріне, содан кейін дыбысталуға назар аударады. Бұған қоса, көптеген ерекше жағдайлар бар, бұл мәселені одан әрі усложнит. Кейбір жалпы ережелерді майор Киаридің "Гифендеу туралы – педантизмнің анархиясы" еңбегінде табуға болады. Гифендеуге қатысты алгоритмдік тәсілдердің ішінде TeX жинақтау жүйесінде қолданылатын тәсіл кеңінен таралған. Ол Дональд Кнуттың "Компьютерлер және жинақтау" атты алғашқы екі томында және Франклин Марк Лянның диссертациясында толыққанды сипатталған. Лянның жұмысының мақсаты – алгоритмді мүмкіндігінше дәл ету және ерекше жағдайларды азайту болды. TeX-тің американдық ағылшын тіліндегі бастапқы гифендеу үлгілеріндегі ерекше жағдайлар тізімінде бар болғаны 14 сөз бар.