Кіріспе
Сөзді немесе морфеманы көрсететін графем. Жазба тілінде логограмма (көне грек тіліндегі "logos" – "сөз", және "gramma" – "салынған немесе жазылған нәрсе") – тілдің семантикалық компонентін, яғни сөзді немесе морфеманы көрсететін жазу белгісі. Қытай тілінде және басқа тілдерде қолданылатын қытай иероглифтері – логограммалар, сондай-ақ мысыр иероглифтері мен клинописьтегі таңбалар да осыған жатады. Логограммаларды негізгі түрде қолданатын жазу жүйесі логография деп аталады. Алфавиттер мен буын жазу жүйелері сияқты логографиялық емес жазу жүйелері фонемалық болып табылады: олардың әрбір белгісі тікелей дыбысты көрсетеді және өздігінен мағынаға ие емес. Дегенмен, барлық белгілі логографияларда қандай да бір фонетикалық компонент болады, ол көбінесе ребус принципіне негізделген. Ал таза идеограммаларға фонетикалық компонентті қосу – жазу жүйесіне адам тілін тиімді түрде кодтауға мүмкіндік берген маңызды жаңалық саналады.
In a written language, a logogram (from Ancient Greek logos 'word', and gramma 'that which is drawn or written'), also logograph or lexigraph, is a written character that represents a semantic component of a language, such as a word or morpheme. Chinese characters as used in Chinese as well as other languages are logograms, as are Egyptian hieroglyphs and characters in cuneiform script. A writing system that primarily uses logograms is called a logography. Non logographic writing systems, such as alphabets and syllabaries, are phonemic: their individual symbols represent sounds directly and lack any inherent meaning. However, all known logographies have some phonetic component, generally based on the rebus principle, and the addition of a phonetic component to pure ideographs is considered to be a key innovation in enabling the writing system to adequately encode human language.
Жіктеу
Логографиялық жүйелерге ең ерте жазу жүйелері жатады; Месопотамия, Египет, Қытай және Мезоамериканың алғашқы тарихи өркениеттері логографиялық жазудың қандай да бір түрін қолданды. Табиғи тілдерде қолданылған барлық логографиялық жазулар салыстырмалы түрде шектеулі логограммалар жиынтығын кеңейту үшін ребус принципіне сүйенеді: таңбалардың бір бөлігі олардың фонетикалық мәндері үшін қолданылады, дауыссыз немесе буындық болып. Осы жазулардың ішінара фонетикалық сипатын, егер фонетикалық сала буын болса, атап көрсету үшін логосиллабарий термині қолданылады. Ежелгі Египет иероглифтерінде, Ч'олти' және қытай тілінде олардың мүмкін мағынасын нақтылау үшін логограммалармен біріктірілген детерминативтер қосымша дамытылды. Қытай тілінде олар фонетикалық мақсатта қолданылатын логографиялық элементтермен біріктіріледі; мұндай "радикал және фонетикалық" таңбалар жазудың басым бөлігін құрайды. Ежелгі египеттіктер мен қытайлар ребусты шетелдік және диалектілік сөздерді жазу үшін белсенді түрде пайдаланды.
Қоңыраулы логотип
Логоконсонанттық жазу жүйелерінде графемалар болады, олар сөздердегі дауыссыз дыбыстарға сәйкес фонетикалық тұрғыдан кеңейтілуі мүмкін, дауысты дыбыстарды ескермейді. Мысалы, египеттік G38 «қаз» (sȝ) және «ұл» (sȝ) сөздерін жазу үшін қолданылған, бірақ бұл сөздердің айтылуы дауыссыз дыбыстардан басқа бірдей болмаған болуы мүмкін. Логоконсонанттық жазу жүйелерінің негізгі мысалдары – египеттік иероглифтер, иератикалық және демотикалық жазу: ежелгі Египет.
Логосиллабикалық
Логосиллабикалық жазу жүйелерінде морфемаларды, көбінесе көп буынды морфемаларды көрсететін графемалар болады, бірақ дыбысталу бойынша кеңейтілгенде бір буынды дыбыстарды бейнелейді. Оларға клинопись, Анатолия иероглифтері, Крит иероглифтері, Сызықтық А және Сызықтық В, қытай иероглифтері, майя жазуы, ацтек жазуы, микстек жазуы және Бамум жазуының алғашқы бес кезеңі кіреді.
Басқалар
Сасанидтер дәуірінің көп бөлігінде орта парсы тілінде жазылған пахлави жазуында (арамей әліпбиінен дамыған) ерекше логограммалар жүйесі қалыптасты; логограммалар арамей тілінде сөзді жазатын, бірақ парсы тілінде айтылатын әріптерден тұрды (мысалы, m l k комбинациясы "шах" деп айтылатын). Бұл логограммалар [[Фраханг и Пахлавиг]] (гетерограммалардың бір түрі) деп аталды, арабтардың Персияны жаулап алуынан және араб әліпбиінің бір түрін қабылдауынан кейін толығымен қолданудан шығарылды.
Семантикалық және фонетикалық өлшемдер
Барлық тарихи логографиялық жүйелер фонетикалық өлшемді қамтиды, себебі тілдегі әрбір сөз немесе морфема үшін жеке негізгі символ жасау ыңғайсыз. Кейбір жағдайларда, мысалы, аккад тілі үшін қолданылған клинописьте, глифтердің көп бөлігі дыбыстық мәндер үшін, логографиялық емес, қолданылады. Көптеген логографиялық жүйелерде семантикалық/идеографиялық компонент те болады (идеограмманы қараңыз), египет тілінде бұл "детерминативтер", ал қытай тілінде "радикалдар" деп аталады. Египеттіктер логограмманы, оның әртүрлі айтылуы бар бірнеше сөзді білдіруі мүмкін, мағынасын нақтылау үшін анықтамалы символмен және айтылуын көрсету үшін фонетикалық компонентпен толықтыруға бейім болды. Қытай тіліндегі таңбалардың көп бөлігі радикалдың – оның атау санатын көрсететін – және айтылуын шамамен білдіретін дыбыстық элементтің тұрақты комбинациясы болып табылады. Майя жүйесі египеттіктер сияқты фонетикалық толықтырулары бар логограммаларды қолданды, бірақ идеографиялық компоненттері болған жоқ.
Қытай таңбалары
Қытай ғалымдары дәстүрлі түрде қытай таңбаларын (hànzì) этимология бойынша алты түрге бөліп отыр. Бірінші екі түрі – "бір денелі", яғни таңба басқа таңбалардан тәуелсіз құрылған. "Бір денелі" пиктограммалар мен идеограммалар қытай логограммаларының аз ғана бөлігін құрайды. Қытай жазуы үшін екі "құрама" әдіс тиімді болды, яғни таңба әртүрлі таңбаларды біріктіруден құрылды. "Құрама" деп аталғанына қарамастан, бұл логограммалар әлі де жеке таңба болып табылады және басқа логограммалар сияқты бірдей орын алу үшін жазылады. Соңғы екі түрі – таңбалардың қалыптасуына емес, таңбаларды қолдану әдістеріне қатысты. Бірінші түрі және қытай жазуымен жиі байланысты түрі – пиктограммалар, олар бейнеленген морфеманың суретін көрсетеді, мысалы 山 – "тау". Екінші түрі – абстракті ұғымдарды бейнелеуге тырысатын идеограммалар, мысалы 上 – "жоғары" және 下 – "төмен". Идеограмма деп саналатын тағы бір белгі – идеографиялық белгісі бар пиктограммалар; мысалы, 刀 – "пышақ" деген мағынаны білдіретін пиктограмма, ал 刃 – "пышақ жүзі" деген мағынаны білдіретін идеограмма. Радикал-радикал қосылыстары, онда таңбаның әр элементі (радикал деп аталады) мағынаға ишара жасайды. Мысалы, 休 'демалу' деген сөз 'адам' (人) және 'ағаш' (木) таңбаларынан тұрады, бұл ағашқа сүйеніп тұрған адам, яғни демалып отырған адамды білдіреді. Радикал-фонетикалық қосылыстар, онда бір компонент (радикал) таңбаның жалпы мағынасын көрсетеді, ал екіншісі (фонетикалық) айтылуына ишара жасайды. Мысалы, 樑 (liáng), онда фонетикалық 梁 liáng таңбаның айтылуын көрсетеді, ал радикал 木 ('ағаш') оның 'қауырсын' деген мағынасын білдіреді. Бұл типтегі таңбалар қытай логограммаларының шамамен 90% құрайды. Өзгертілген түсіндірме таңбалары – бұл бастапқыда бір таңба болған, бірақ орфографиялық және көбінесе семантикалық өзгерістерге байланысты екіге бөлінген таңбалар. Мысалы, 樂 / 乐 сөзі 'музыка' (yuè) және 'құаныш' (lè) деген мағынаны білдіреді. Импровизациялық таңбалар (әдебиетте 'қарыз сөздер') ана тіліндегі сөздің сәйкес таңбасы болмаған кезде қолданылады, сондықтан бірдей немесе ұқсас дыбысы (әдетте жақын мағынасы бар) басқа таңба 'қарызға' алынады; кейде жаңа мағына ескі мағынаны ығыстыра алады. Мысалы, 自 бұрын 'мұрын' деген мағынаны білдіретін пиктографиялық сөз болған, бірақ ол 'өзі' деген мағынаны білдіру үшін қарызға алынған, қазір осы мағынада ғана қолданылады; алғашқы мағынасы тек тұрақты тіркестерде және архаикалық қосылыстарда сақталған. Туынды процесіне байланысты, жапон канасының барлық жиынтығы осы типтегі таңбалар деп қарастырылуы мүмкін, сондықтан кана (әдебиетте 'қарыз есімдер') деп аталады. Мысал: Жапонның 仮名; 仮 – Корея мен Жапонияда қолданылатын қытайлық 假-ның оңайлатылған түрі, ал 假借 – осы типтегі таңбалардың қытайша атауы. Қытай жазуының ең өнімді әдісі – радикал-фонетикалық әдіс – дыбыс жүйесіндегі белгілі бір айырмашылықтарды ескермеу арқылы мүмкін болды. Ежелгі қытай тілінде соңғы буынның соңғы дауыссыз дыбыстары ескерілмеген; олар орта қытай тілінде жаңа таңбалар жасалғанда ескерілмеген тонға айналды. Сондай-ақ, аспирациядағы айырмашылықтар (аспирацияланған және аспирацияланбаған кедергілер, дауысты және дауыссыз соноранттар арасында); Ежелгі қытай тілінде А және В типтегі буындар арасындағы айырмашылық (көбінесе тілдің таңдалуы немесе фарингелизациясының болуы немесе болмауы ретінде сипатталады); және кейде, алғашқы кедергілердің дауыстылығы және/немесе алғашқы дауыссыз дыбыстан кейін медиалдың болуы. Бұрын көбірек фонетикалық еркіндікке рұхсат етілген. Орта қытай дәуірінде жаңадан жасалған таңбалар, тоннан басқа, айтылуына дәл сәйкес келеді, көбінесе фонетикалық компонент ретінде өзі радикал-фонетикалық қосылыс болып табылатын таңбаны пайдаланады. Тілдің ұзақ эволюциялық кезеңіне байланысты, радикал-фонетикалық қосылыстармен қамтамасыз етілген таңбалар ішіндегі мұндай компоненттік 'ишаралар' кейде пайдасыз және қазіргі қолданыста шатастырушы болуы мүмкін. Мысалы, стандартты мандарин тілінде 'мей' деп айтылатын 每 'әрқайсысы' негізінде, 侮 'қорлау', 悔 'өкіну' және 海 'теңіз' таңбалары бар, олар мандарин тілінде сәйкесінше 'у' (wǔ), 'хуэй' (huǐ) және 'хай' (hǎi) деп айтылады. Осы таңбалардың үшеуі көне қытай тілінде өте ұқсас айтылған (每), (悔) және (海) – Уильям Х. Бакстер мен Лоран Сагарттың соңғы зерттеуіне сәйкес, бірақ соңғы 3000 жыл ішіндегі дыбыстық өзгерістер (соңғы екі таңбаның жағдайында екі түрлі диалектілік даму) айтарлықтай өзгеше айтылуына әкелді.
"compound" methods, i. e. the character was created from assembling different characters. Despite being called "compounds", these logograms are still single characters, and are written to take up the same amount of space as any other logogram. The final two types are methods in the usage of characters rather than the formation of characters themselves. The first type, and the type most often associated with Chinese writing, are pictograms, which are pictorial representations of the morpheme represented, e. g. 山 for 'mountain'. The second type are the ideograms that attempt to visualize abstract concepts, such as 上 'up' and 下 'down'. Also considered ideograms are pictograms with an ideographic indicator; for instance, 刀 is a pictogram meaning 'knife', while 刃 is an ideogram meaning 'blade'. Radical–radical compounds, in which each element of the character (called radical) hints at the meaning. For example, 休 'rest' is composed of the characters for 'person' (人) and 'tree' (木), with the intended idea of someone leaning against a tree, i. e. resting. Radical–phonetic compounds, in which one component (the radical) indicates the general meaning of the character, and the other (the phonetic) hints at the pronunciation. An example is 樑 (liáng), where the phonetic 梁 liáng indicates the pronunciation of the character and the radical 木 ('wood') indicates its meaning of 'supporting beam'. Characters of this type constitute around 90% of Chinese logograms. Changed annotation characters are characters which were originally the same character but have bifurcated through orthographic and often semantic drift. For instance, 樂 / 乐 can mean both 'music' (yuè) and 'pleasure' (lè). Improvisational characters (lit. 'improvised borrowed words') come into use when a native spoken word has no corresponding character, and hence another character with the same or a similar sound (and often a close meaning) is "borrowed"; occasionally, the new meaning can supplant the old meaning. For example, 自 used to be a pictographic word meaning 'nose', but was borrowed to mean 'self', and is now used almost exclusively to mean the latter; the original meaning survives only in stock phrases and more archaic compounds. Because of their derivational process, the entire set of Japanese kana can be considered to be of this type of character, hence the name kana (lit. 'borrowed names'). Example: Japanese 仮名; 仮 is a simplified form of Chinese 假 used in Korea and Japan, and 假借 is the Chinese name for this type of characters. The most productive method of Chinese writing, the radical phonetic, was made possible by ignoring certain distinctions in the phonetic system of syllables. In Old Chinese, post final ending consonants and were typically ignored; these developed into tones in Middle Chinese, which were likewise ignored when new characters were created. Also ignored were differences in aspiration (between aspirated vs. unaspirated obstruents, and voiced vs. unvoiced sonorants); the Old Chinese difference between type A and type B syllables (often described as presence vs. absence of palatalization or pharyngealization); and sometimes, voicing of initial obstruents and/or the presence of a medial after the initial consonant. In earlier times, greater phonetic freedom was generally allowed. During Middle Chinese times, newly created characters tended to match pronunciation exactly, other than the tone – often by using as the phonetic component a character that itself is a radical phonetic compound. Due to the long period of language evolution, such component "hints" within characters as provided by the radical phonetic compounds are sometimes useless and may be misleading in modern usage. As an example, based on 每 'each', pronounced měi in Standard Mandarin, are the characters 侮 'to humiliate', 悔 'to regret', and 海 'sea', pronounced respectively wǔ, huǐ, and hǎi in Mandarin. Three of these characters were pronounced very similarly in Old Chinese – (每), (悔), and (海) according to a recent reconstruction by William H. Baxter and Laurent Sagart – but sound changes in the intervening 3,000 years or so (including two different dialectal developments, in the case of the last two characters) have resulted in radically different pronunciations.
Жапон және корей тілдерінде қолданылатын қытай таңбалары
Қытай тілінде қытай таңбалары (ханзи деп аталады) көбінесе идеялар емес, сөздер мен морфемаларды көрсетеді. Дегенмен, жапон және корей тілдерінің қытай таңбаларын қабылдауы (сәйкесінше кандзи және ханжа деп аталады) бұл тұрғыда қыңырлықтар тудырды. Қытай морфемаларынан құралған көптеген қытай сөздері олардың таңбалық бейнелерімен бірге жапон және корей тілдеріне алынды; мұндай жағдайда морфемалар мен таңбалар бірге қарызға алынды. Бірақ, кейде таңбалар тек мағынасы бойынша жапон және корей тілдерінің тума сөздерін бейнелеу үшін алынды. Осының салдарынан, бір таңба бірнеше тілде ұқсас мағыналы, бірақ әртүрлі текті бірнеше морфеманы көрсете алады. Осы себепті, кандзи мен ханжа кейде морфографиялық жазу жүйесі ретінде сипатталады.
Логографиялық және фонологиялық жазу жүйелерін өңдеудегі айырмашылықтар
Тіл өңдеу саласындағы көптеген зерттеулер ағылшын және басқа да әліпбилік жазба тілдеріне негізделгендіктен, тіл өңдеудің көптеген теориялары сөйлеуді жасауда фонологияның ролін баса көрсетті. Бір таңба фонетикалық және идеографиялық түрде бейнеленетін логографиялық кодталған тілдерді, фонетикалық/фонемиялық жазылымдағы тілдермен салыстыру, әртүрлі тілдердің әртүрлі өңдеу механизмдеріне қалай сүйенетіні туралы түсініктер берді. Логографиялық кодталған тілдерді өңдеуге қатысты зерттеулер, басқалармен қатар, өңдеудегі нейробиологиялық айырмашылықтарды қарастырды, олардың ішінде ерекше қызығушылық тудырған сала – екі жарты шардың басымдығы. Логографиялық кодталған тілдер алфавиттік кодталған тілдерге қарағанда бейнелермен тығыз байланысты болғандықтан, бірнеше зерттеушілер оң жақ белсенділігі логографиялық кодталған тілдерде күштірек болуы керек деп болжады. Кейбір зерттеулер осы гипотезаны қолдайтын нәтижелер көрсеткенімен, орфографиялық және фонетикалық кодталған тілдердегі екі жарты шардың басымдығының ролі туралы нақты қорытынды жасауға жеткілікті мәлімет жоқ. Тағы бір назар аударатын мәселе – гомофондарды өңдеудегі айырмашылықтар. Verdonschot және авторлар тобы гомофондық кейіпкерге қатысты немесе қатысы жоқ сурет көрсетілген кезде гомофондық кейіпкерді дауыстап оқуға кеткен уақыттың айырмашылығын зерттеді. Жапон және қытай гомофондары зерттелді. Алфавиттік кодталған тілдердің (мысалы, ағылшын тілінің) сөз өндірісі контексттік ынталандырулардың әсеріне салыстырмалы түрде төзімді болса, Verdonschot және авторлар тобы жапон гомофондары осы әсерлерге ерекше сезімтал екенін анықтады. Атап айтқанда, қатысушыларға мақсатты таңбаны дауыстап оқуды сұрамас бұрын фонологиялық байланысты сурет көрсетілген кезде реакция уақыты қысқа болды. Зерттеудегі фонологиялық байланысты ынталандырудың мысалы – қатысушыларға япон тілінде "zou" деп айтылатын піл суретін көрсету, содан кейін қытай таңбасы 造-ны көрсету, оны да "zou" деп оқиды. Қытай сөздерін оқу реакция уақытында фонологиялық байланысты контексттік суреттердің әсері байқалған жоқ. Жапон және қытай тілдерін салыстыру қызығушылық тудырады, себебі жапон тілінде 60%-дан астам гомографиялық гетерофондар (екі немесе одан көп түрлі жолмен оқылатын таңбалар) бар, ал қытай таңбаларының көпшілігі тек бір оқылымға ие. Екі тіл де логографиялық кодталғандықтан, жапон және қытай тілдерін дауыстап оқудың уақытындағы айырмашылықты жазу жүйелерінің логографиялық сипатына байланыстыруға болмайды. Авторлар болжам бойынша, жапон тіліндегі уақыт айырмашылығы қосымша өңдеу шығындарына байланысты, онда оқырман тек тікелей орфографиялық-фонологиялық байланысқа ғана емес, сонымен қатар дұрыс айтылуын таңдау үшін лексикалық-синтаксистік деңгейдегі ақпаратқа да жүгінуі керек. Бұл гипотезаны зерттеулер растайды, япониялық Альцгеймер ауруымен ауыратын науқастар таңбаларды түсіну қабілеті нашарлаған жағдайда да сөздерді дауыстап оқи алады. Лексикалық шешімдерді қабылдау тапсырмаларында ағылшын және қытай тілдеріндегі гомофондарды өңдеуді салыстыратын зерттеулер қытай тілінде гомофондарды өңдеудің артықшылығын, ал ағылшын тілінде гомофондарды өңдеудің кемшілігін анықтады. Ағылшын тіліндегі өңдеу кемшілігі әдетте ағылшын тіліндегі гомофондардың жетіспеушілігімен түсіндіріледі. Гомофоникалық сөз кездескенде, алдымен сол сөздің фонологиялық бейнесі белсендіріледі. Алайда, бұл екіұшты ынталандыру болғандықтан, ынталандыруды ажырату үшін орфографиялық/лексикалық ("ақыл сөздігі") деңгейінде сәйкестендіру қажет, содан кейін дұрыс айтылуын таңдауға болады. Керісінше, көптеген бір оқылымды таңбалары бар тілде (мысалы, қытай тілінде) таңбаны оқитын адам гомофондармен жақсы таныс болуы мүмкін, және бұл таныстық таңбаны өңдеуге және кейіннен дұрыс айтылуын таңдауға көмектеседі, нәтижесінде ынталандыруға назар аударғанда реакция уақыты қысқарады. Гомофонияның өңдеуге әсерін жақсырақ түсіну үшін Hino және авторлар тобы зерттеу жүргізді, бірақ бұған дәлел таппады. Логографиялық және әліпбилік кодталған тілдерде гомофондарды өңдеуде айырмашылық бар екені анық, бірақ гомофондарды өңдеудің артықшылығы логографиялық кодталған жапон және қытай тілдерінде (яғни олардың жазу жүйелерінде) жазулардың логографиялық сипатына байланысты ма, әлде бұл жазу жүйесіне қарамастан, гомофондардың көп болуына байланысты тілдерге тән артықшылықты көрсете ме, әлі анықтау керек.
Жазу мен айтылудың ажыратылуы
Логограммалар мен басқа жазу жүйелерінің басты айырмашылығы – графемалардың олардың айтылуымен тікелей байланысты болмауы. Осы айырмашылықтың артықшылығы – жазушының айтылуын немесе тілін түсінудің қажеті жоқ, мысалы, «1» саны оқырман оны «бір», «ичи» немесе «вахид» деп атағанына қарамастан түсініледі. Сол сияқты, қытай тілінің әртүрлі диалектілерінде сөйлейтін адамдар бір-бірін сөйлескенде түсінбеуі мүмкін, бірақ стандартты қытай тілінде жазбаса да, жазу арқылы біршама түсіне алады. Сондықтан, Қытай, Вьетнам, Корея және Жапонияда ежелгі заманға дейін жазбаша байланыс (筆談) – классикалық қытай тілінде Шығыс Азияның халықаралық саудасы мен дипломатиясының негізгі құралы болды. Алайда, осы айырмашылықтың үлкен кемшілігі де бар: оқу мен жазуды үйренгенде логограммаларды олардың айтылуынан бөлек жаттап алу қажет. Жапон тілінің даму тарихы ерекше, бірақ бұл логограммалардың табиғи ерекшелігі емес, керісінше, әрбір логограмманың бірнеше айтылуы бар. Ал фонетикалық таңбалар жиынтығы дәл айтылғандай жазылады, бірақ айтылудың шамалы өзгешеліктері түсініксіздіктер тудыруы мүмкін. Грек, латын, итальян, испан және фин тілдері сияқты көптеген әліпбилік жүйелер, әріптер мен дыбыстар арасындағы шамамен бір-бірге сәйкестікті сақтай отырып, сөздерді жазудың стандартталған тәсілін табуға тырысады. Ағылшын, француз, тай және тибет тілдеріндегі орфография одан да күрделі: кейбір әріптердің біріккен комбинациялары әртүрліше айтылады, көбінесе олардың тарихына байланысты. Корей тілінің жазу жүйесі – хангуль, ол сауаттылық деңгейін арттыру мақсатында логограммалық ханжаның орнына жасалған әліпбилік жазудың мысалы. Ханжа қазір сирек қолданылады, бірақ Оңтүстік Кореяда белгілі бір деңгейде қолданылады, кейде хангульмен бірге. Үкімет тапсырысымен жүргізілген зерттеулерге сәйкес, Қытай Халық Республикасының «Қазіргі заманғы қытай тілінің жиі қолданылатын таңбаларының тізімі» (现代汉语常用字表, Xiàndài Hànyǔ Chángyòngzì Biǎo) тізіміндегі ең көп қолданылатын 3500 таңба екі миллион сөздік корпустың 99,48%-ын құрайды. Ал дәстүрлі қытай таңбаларына келетін болсақ, Қытай Республикасының Білім министрлігінің «Жалпы ұлттық таңбалардың стандартты түрінің тізімі» (常用國字標準字體表) тізімінде 4808 таңба, ал Гонконгтың Білім және еңбек күштері бюросының «Жалпы қолданылатын қытай таңбаларының пішіндерінің тізімі» (常用字字形表) тізімінде 4759 таңба келтірілген. Бұл тізімдер бастауыш мектепте және орта білім беруде оқытылатын таңбаларды қамтиды. Ал бастауыш мектептен кейінгі білім беруде жаңа таңбаларды емес, көбінесе екі немесе одан да көп бұрын үйренген таңбалардың комбинациясынан құралған жаңа сөздерді оқуға көбірек назар аударылады.
Ақпараттық технологиядағы кейіпкерлер
Электрондық құрылғыларда күрделі таңбаларды енгізу, кіріс пернелерінің санының практикалық шектеулеріне байланысты, қиындық тудыруы мүмкін. Логограммаларды енгізудің әртүрлі әдістері бар: оларды құраушы бөліктерге бөлу арқылы, мысалы, қытай тілін терудің Канцзи және Вуби әдістері арқылы, немесе Bopomofo немесе Пиньин сияқты дыбыстамалық жүйелерді қолдану арқылы – сөз айтылғандай енгізіліп, содан кейін оған сәйкес логограммалар тізімінен таңдалады. Бірінші әдіс (сызықтық) жағынан жылдам болғанымен, оны үйрену қиынырақ. Дегенмен, қытай алфавиті жүйесінде логограмманы құрайтын сызықтар олар қалай жазылатындығына сәйкес теріледі, содан кейін тиісті логограмма енгізіледі. Сонымен қатар, глифтердің көп санына байланысты, бағдарламалау және жалпы есептеулерде әр графеманы сақтау үшін көбірек жад қажет, себебі таңбалар жиынтығы үлкен. Мысалы, ISO 8859 әр графема үшін бір байтты ғана қажет етеді, ал UTF 8-де кодталған Негізгі көптілді жазықтықта үш байтқа дейін қажет болуы мүмкін. Ал ағылшын тіліндегі сөздердің орташа ұзындығы бес таңбадан және бір бос орыннан тұрады, яғни әр сөз үшін алты байт керек. Көптеген логограммалар бірнеше графемадан тұратындықтан, қайсысы жадты тиімдірек пайдаланатыны белгісіз. Айырмашылық ендіктегі кодтамалар Unicode сияқты бірыңғай таңба кодтау стандартына таңбаны көрсету үшін қажетті байттарды ғана пайдалануға мүмкіндік береді, бұл үлкен таңбалар жиынтығын кішірек жиынтықтармен біріктіруден туындайтын қосымша шығындарды азайтады.