Кіріспе
Кодталған таңбалар жиынтығындағы таңбаны көрсететін сандық мән. Кодтық нүкте, кодтық нүкте немесе кодтық позиция – семантикалық мағынасы тағайындалған квантталған n өлшемді кеңістіктегі бірегей орын. Яғни, кодтық нүкте – кестедегі нақты белгілі бір орын, сол орынға мағына берілген. Кесте дискретті орындардан тұрады (1, 2, 3, 4, бөлшектері жоқ) және бір өлшемді (баған), екі өлшемді (кестедегі жасушалар сияқты), үш өлшемді (жұмыс кітапшасындағы парақтар) және т.б., өлшемдер саны кез келген болуы мүмкін. Кодтық нүктелер көптеген ресми ақпаратты өңдеу және телекоммуникация стандарттарында қолданылады. Мысалы, ITU-T T.35 ұсынымында телекоммуникациялық құралдар (бастапқыда факс машиналарын) үшін ел кодтарының жиынтығы бар, ол құралға өндірілген немесе жұмыс істейтін елін көрсетуге мүмкіндік береді. T.35 бойынша Аргентина 0x07, Канада 0x20, Гамбия 0x41 және т.б. кодтарымен белгіленеді.
A code point, codepoint or code position is a unique position in a quantized n dimensional space that has been assigned a semantic meaning. In other words, a code point is a particular position in a table, where the position has been assigned a meaning. The table has discrete positions (1, 2, 3, 4, but not fractions) and may be one dimensional (a column), two dimensional (like cells in a spreadsheet), three dimensional (sheets in a workbook), etc in any number of dimensions. Code points are used in a multitude of formal information processing and telecommunication standards. For example ITU T Recommendation T.35 contains a set of country codes for telecommunications equipment (originally fax machines) which allow equipment to indicate its country of manufacture or operation. In T.35, Argentina is represented by the code point 0x07, Canada by 0x20, Gambia by 0x41, etc.
Таңба кодтауында
Кодтық нүктелер әдетте таңба кодтауда қолданылады, онда кодтық нүкте – белгілі бір таңбаға сәйкес келетін сандық мән. Таңба кодтау нүктелері көбінесе бір графеманы көрсетеді – әдетте әріп, цифр, тыныш белгісі немесе бос орын, бірақ кейде символдарды, басқару таңбаларын немесе форматтауды көрсетеді. Белгілі бір кодтау/таңбалар жиынтығындағы барлық мүмкін кодтық нүктелердің жиынтығы осы кодтаудың кодтық кеңістігін құрайды. Мысалы, ASCII таңба кодтау схемасы 0hex-тен 7Fhex-ке дейінгі диапазонмен 128 кодтық нүктені қамтиды, кеңейтілген ASCII 0hex-тен FFhex-ке дейінгі диапазонмен 256 кодтық нүктені қамтиды, ал Unicode 0hex-тен 10FFFFhex-ке дейінгі диапазонмен кодтық нүктелерді қамтиды. Unicode кодтық кеңістігі он жеті жазықтыққа бөлінеді (негізгі көптілді жазықтық және 16 қосымша жазықтық), олардың әрқайсысы 65536 (= 216) кодтық нүктені қамтиды. Осылайша Unicode кодтық кеңістігінің жалпы көлемі 17 × 65536 = 1114112 болады.
Юникодпен
Unicode үшін биттердің белгілі бір тізбегі код бірлігі деп аталады. UCS-4 кодтауында кез келген код нүктесі 4 байттан (октеттен) тұратын екілік сан түрінде кодталады, ал UTF-8 кодтауында әртүрлі код нүктелері бірден төрт байтқа дейінгі тізбектер ретінде кодталады, бұл өзін-өзі синхрондаушы кодты құрайды. Толығырақ ақпарат алу үшін Unicode кодтауларының салыстыруына қараңыз. Код нүктелері әдетте абстрактілі таңбаларға сәйкес келеді. Абстрактілі таңба – графикалық глиф емес, мәтіндік деректердің бірлігі. Дегенмен, код нүктелері болашақта қолдану үшін резервте қалдырылуы мүмкін (Unicode код кеңістігінің көп бөлігі бос) немесе басқа белгілі бір функцияларға берілуі мүмкін. Код нүктесі мен оған сәйкес келетін абстрактілі таңба арасындағы айырмашылық Unicode-та айқын емес, бірақ көптеген басқа кодтау жүйелерінде жақсы көрінеді, онда бір код кеңістігі үшін көптеген код беттері болуы мүмкін.
Тарих
Кодтық нүкте ұғымы цифрлық ақпаратты өңдеу және цифрлық телекоммуникациялардың ең алғашқы стандарттарымен байланысты. Юникодта кодтық нүктелер – 1980-ші жылдары таңбалық кодтауды әзірлеушілер алдында тұрған қиын мәселені шешуге Юникодтың жасаған жауабының бір бөлігі. Егер олар үлкенірек таңбалар жиынтығын қолдау үшін әр таңбаға көбірек бит қосса, онда бұл дизайндық шешім латын әрпін пайдаланушылар үшін (сол кезде компьютер пайдаланушыларының басым көпшілігі осылар болатын) сол кездегі сирек есептеу ресурстарын қабылдамас деңгейде ысыраптауға әкелмек, себебі осы қосымша биттер мұндай пайдаланушылар үшін әрқашан нөлге тең болар еді. Кодтық нүкте бұл мәселені таңбалар мен биттердің нақты тізбектері арасындағы тікелей, бір-бірге сәйкестік туралы бұрынғы идеяны жою арқылы болдырмайды.