Введение
Графема, представляющая слово или морфему.
В письменном языке логограмма (от древнегреческого logos — «слово» и gramma — «нарисованное или написанное»), также логограф или лексиграмма, — это письменный знак, представляющий смысловую единицу языка, такую как слово или морфема. Китайские иероглифы, используемые в китайском языке и других языках, являются логограммами, как и египетские иероглифы и знаки клинописного письма. Система письма, преимущественно использующая логограммы, называется логографией. Нелогографические системы письма, такие как алфавиты и слоговые системы, являются фонемическими: их отдельные знаки непосредственно представляют звуки и не имеют самостоятельного значения. Однако все известные логографии содержат определенный фонетический компонент, обычно основанный на принципе ребуса, и добавление фонетического компонента к чистым идеограммам считается ключевым нововведением, позволившим системе письма адекватно кодировать человеческий язык.
Классификация
Логографические системы включают в себя самые ранние системы письма; первые исторические цивилизации Месопотамии, Египта, Китая и Мезоамерики использовали ту или иную форму логографического письма. Все логографические письменности, когда-либо использовавшиеся для естественных языков, опираются на принцип ребуса для расширения относительно ограниченного набора логограмм: часть символов используется для обозначения их фонетических значений, будь то согласные или слоги. Термин «логосиллабарий» используется для подчеркивания частично фонетического характера этих письменностей, когда фонетической единицей является слог. В древнеегипетских иероглифах, письме ч’олти’ и китайском языке дополнительно развились детерминативы, которые сочетаются с логограммами для уточнения их возможного значения. В китайском языке они сливаются с логографическими элементами, используемыми фонетически; такие «радикально-фонетические» иероглифы составляют основную часть письменности. Древние египтяне и китайцы ограничили активное использование ребуса написанием иностранных слов и диалектизмов.
Логотипконсонантальный
В логоконсонантных системах письма графемы могут быть фонетически расширены в соответствии с согласными звуками тех слов, которые они представляют, игнорируя гласные. Например, египетский знак G38 использовался для записи слов sȝ «утка» и sȝ «сын», хотя, вероятно, эти слова произносились по-разному, за исключением совпадающих согласных. Основными примерами логоконсонантного письма являются египетские иероглифы, иератическое и демотическое письмо: древнеегипетский язык.
Логосиллабический
В логосиллабических системах письма графемы обозначают морфемы, часто полисиллабические, но при фонетическом расширении могут представлять отдельные слоги. К ним относятся клинопись, анатолийские иероглифы, критские иероглифы, линейное письмо А и линейное письмо Б, китайские иероглифы, письменность майя, ацтекская письменность, микстекская письменность и первые пять этапов письменности бамум.
Другие
Особая система логограмм, разработанная в рамках пехлеви (разработанная из арамейской абджады), использовалась для записи среднеперсидского языка на протяжении большей части сасанидского периода; логограммы составлялись из букв, которые записывали слово на арамейском языке, но произносились по-персидски (например, сочетание m l k произносилось как "шах"). Эти логограммы, известные как [[Frahang i Pahlavig] (являющиеся формой гетерограмм), полностью исчезли после арабского завоевания Персии и перехода на вариант арабского алфавита.
Семантические и фонетические измерения
Все исторические логографические системы включают в себя фонетический компонент, поскольку непрактично иметь отдельный базовый знак для каждого слова или морфемы в языке. В некоторых случаях, например, клинопись, использовавшаяся для аккадского языка, подавляющее большинство глифов используется для обозначения их звуковых значений, а не логографически. Многие логографические системы также имеют семантический/идеографический компонент (см. идеограмма), называемый "детерминативами" в египетском языке и "радикалами" в китайском языке. Типичный египетский способ заключался в том, чтобы дополнить логограмму, которая потенциально может представлять несколько слов с разным произношением, детерминативом для сужения значения и фонетическим компонентом для уточнения произношения. В китайском языке подавляющее большинство иероглифов представляет собой фиксированное сочетание радикала, указывающего на его номинальную категорию, и фонетического компонента, дающего представление о произношении. Система письма майя использовала логограммы с фонетическими дополнениями, подобно египетской, но без идеографических компонентов.
Китайские символы
Китайские ученые традиционно классифицируют китайские иероглифы (hànzì) на шесть типов по этимологии. Первые два типа – "одно тело", что означает, что иероглиф был создан независимо от других иероглифов. Пиктограммы и идеограммы типа "одно тело" составляют лишь небольшую долю китайских логограмм. Более продуктивными для китайской письменности были два "сложных" метода, то есть иероглиф создавался путем соединения различных иероглифов. Несмотря на название "сложные", эти логограммы остаются едиными иероглифами и занимают столько же места, сколько любой другой логограмм. Последние два типа – это методы использования иероглифов, а не их формирования. Первый тип, наиболее часто ассоциирующийся с китайской письменностью, – это пиктограммы, являющиеся изобразительными представлениями морфемы, например, 山 для 'горы'. Второй тип – это идеограммы, которые пытаются визуализировать абстрактные понятия, такие как 上 'вверх' и 下 'вниз'. Также к идеограммам относятся пиктограммы с идеографическим показателем; например, 刀 – пиктограмма, означающая 'нож', а 刃 – идеограмма, означающая 'лезвие'. Составные радикально-радикальные иероглифы, в которых каждый элемент иероглифа (называемый радикалом) намекает на его значение. Например, 休 'отдых' состоит из иероглифов для 'человек' (人) и 'дерево' (木), с подразумеваемой идеей человека, опирающегося на дерево, то есть отдыхающего. Составные радикально-фонетические иероглифы, в которых один компонент (радикал) указывает на общее значение иероглифа, а другой (фонетический) намекает на произношение. Примером является 樑 (liáng), где фонетический 梁 liáng указывает на произношение иероглифа, а радикальный 木 ('дерево') – на его значение 'подпорная балка'. Иероглифы этого типа составляют около 90% китайских логограмм. Измененные иероглифы-аннотации – это иероглифы, которые изначально были одним и тем же иероглифом, но разделились в результате орфографического и часто семантического сдвига. Например, 樂 / 乐 может означать и 'музыку' (yuè), и 'удовольствие' (lè). Импровизированные иероглифы (лит. 'импровизированные заимствованные слова') появляются, когда для родного слова нет соответствующего иероглифа, и поэтому "заимствуется" другой иероглиф с тем же или похожим звучанием (и часто близким значением); иногда новое значение может вытеснить старое. Например, 自 раньше было пиктографическим словом, означающим 'нос', но было заимствовано для обозначения 'я', и теперь используется почти исключительно в этом значении; первоначальное значение сохранилось только в устойчивых выражениях и более архаичных соединениях. В силу своего процесса образования, весь набор японских кана можно считать иероглифами этого типа, отсюда и название кана (лит. 'заимствованные имена'). Пример: японский 仮名; 仮 – упрощенная форма китайского 假, используемая в Корее и Японии, а 假借 – китайское название для этого типа иероглифов. Наиболее продуктивный метод китайской письменности, радикально-фонетический, стал возможен благодаря игнорированию определенных различий в фонетической системе слогов. В древнекитайском языке конечные согласные и обычно игнорировались; они превратились в тоны в среднекитайском языке, которые также игнорировались при создании новых иероглифов. Также игнорировались различия в аспирации (между придыхательными и непридыхательными согласными, и звонкими и глухими сонантами); различие между слогами типа А и типа В в древнекитайском языке (часто описываемое как наличие и отсутствие палатализации или фарингализации); и иногда, звонкость начальных согласных и/или наличие медиального после начального согласного. В более ранние времена допускалась большая фонетическая свобода. В среднекитайский период вновь созданные иероглифы, как правило, точно соответствовали произношению, за исключением тона, – часто используя в качестве фонетического компонента иероглиф, который сам является радикально-фонетическим соединением. Из-за длительного периода эволюции языка такие компоненты-"подсказки" в иероглифах, предоставляемые радикально-фонетическими соединениями, иногда бесполезны и могут вводить в заблуждение в современном использовании. Например, на основе 每 'каждый', произносится měi в стандартном мандаринском диалекте, находятся иероглифы 侮 'унижать', 悔 'сожалеть' и 海 'море', произносимые соответственно wǔ, huǐ и hǎi в мандаринском диалекте. Три из этих иероглифов произносились очень похоже в древнекитайском языке – (每), (悔) и (海) согласно недавней реконструкции Уильяма Х. Бакстера и Лорана Сагара – но изменения в произношении за прошедшие примерно 3000 лет (включая два различных диалектальных развития, в случае последних двух иероглифов) привели к радикально различающемуся произношению.
"compound" methods, i. e. the character was created from assembling different characters. Despite being called "compounds", these logograms are still single characters, and are written to take up the same amount of space as any other logogram. The final two types are methods in the usage of characters rather than the formation of characters themselves. The first type, and the type most often associated with Chinese writing, are pictograms, which are pictorial representations of the morpheme represented, e. g. 山 for 'mountain'. The second type are the ideograms that attempt to visualize abstract concepts, such as 上 'up' and 下 'down'. Also considered ideograms are pictograms with an ideographic indicator; for instance, 刀 is a pictogram meaning 'knife', while 刃 is an ideogram meaning 'blade'. Radical–radical compounds, in which each element of the character (called radical) hints at the meaning. For example, 休 'rest' is composed of the characters for 'person' (人) and 'tree' (木), with the intended idea of someone leaning against a tree, i. e. resting. Radical–phonetic compounds, in which one component (the radical) indicates the general meaning of the character, and the other (the phonetic) hints at the pronunciation. An example is 樑 (liáng), where the phonetic 梁 liáng indicates the pronunciation of the character and the radical 木 ('wood') indicates its meaning of 'supporting beam'. Characters of this type constitute around 90% of Chinese logograms. Changed annotation characters are characters which were originally the same character but have bifurcated through orthographic and often semantic drift. For instance, 樂 / 乐 can mean both 'music' (yuè) and 'pleasure' (lè). Improvisational characters (lit. 'improvised borrowed words') come into use when a native spoken word has no corresponding character, and hence another character with the same or a similar sound (and often a close meaning) is "borrowed"; occasionally, the new meaning can supplant the old meaning. For example, 自 used to be a pictographic word meaning 'nose', but was borrowed to mean 'self', and is now used almost exclusively to mean the latter; the original meaning survives only in stock phrases and more archaic compounds. Because of their derivational process, the entire set of Japanese kana can be considered to be of this type of character, hence the name kana (lit. 'borrowed names'). Example: Japanese 仮名; 仮 is a simplified form of Chinese 假 used in Korea and Japan, and 假借 is the Chinese name for this type of characters. The most productive method of Chinese writing, the radical phonetic, was made possible by ignoring certain distinctions in the phonetic system of syllables. In Old Chinese, post final ending consonants and were typically ignored; these developed into tones in Middle Chinese, which were likewise ignored when new characters were created. Also ignored were differences in aspiration (between aspirated vs. unaspirated obstruents, and voiced vs. unvoiced sonorants); the Old Chinese difference between type A and type B syllables (often described as presence vs. absence of palatalization or pharyngealization); and sometimes, voicing of initial obstruents and/or the presence of a medial after the initial consonant. In earlier times, greater phonetic freedom was generally allowed. During Middle Chinese times, newly created characters tended to match pronunciation exactly, other than the tone – often by using as the phonetic component a character that itself is a radical phonetic compound. Due to the long period of language evolution, such component "hints" within characters as provided by the radical phonetic compounds are sometimes useless and may be misleading in modern usage. As an example, based on 每 'each', pronounced měi in Standard Mandarin, are the characters 侮 'to humiliate', 悔 'to regret', and 海 'sea', pronounced respectively wǔ, huǐ, and hǎi in Mandarin. Three of these characters were pronounced very similarly in Old Chinese – (每), (悔), and (海) according to a recent reconstruction by William H. Baxter and Laurent Sagart – but sound changes in the intervening 3,000 years or so (including two different dialectal developments, in the case of the last two characters) have resulted in radically different pronunciations.
Китайские символы, используемые в японском и корейском языках
В контексте китайского языка китайские иероглифы (известные как ханьцзы) в основном представляют слова и морфемы, а не абстрактные понятия; однако заимствование китайских иероглифов японским и корейским языками (где они известны как кандзи и ханджа соответственно) внесло некоторые сложности в эту картину. Многие китайские слова, состоящие из китайских морфем, были заимствованы в японский и корейский языки вместе с их иероглифическим написанием; в этом случае морфемы и иероглифы заимствовались одновременно. Однако в других случаях иероглифы заимствовались для обозначения исконных японских и корейских морфем, исключительно на основе значения. В результате один и тот же иероглиф может оказаться обозначающим несколько морфем с близким значением, но разным происхождением в разных языках. По этой причине кандзи и ханджа иногда описываются как морфографические системы письма.
Различия в обработке логографических и фонологических систем письма
Поскольку значительная часть исследований обработки языка была сосредоточена на английском и других языках с алфавитным письмом, многие теории обработки языка подчеркивали роль фонологии в порождении речи. Сопоставление языков с логографическим кодированием, где один символ представлен как фонетически, так и идеографически, с языками, в которых используется фонетическое/фонемное написание, позволило получить представление о том, как различные языки опираются на разные механизмы обработки. Исследования обработки языков с логографическим кодированием, в частности, изучали нейробиологические различия в обработке, при этом одной из областей особого интереса является полушарная латерализация. Поскольку языки с логографическим кодированием теснее связаны с образами, чем языки с алфавитным кодированием, ряд исследователей предположили, что активация правого полушария должна быть более выраженной в языках с логографическим кодированием. Хотя некоторые исследования дали результаты, согласующиеся с этой гипотезой, существует слишком много противоречивых результатов, чтобы делать какие-либо окончательные выводы о роли полушарной латерализации в языках с орфографическим и фонетическим кодированием. Другой темой, получившей некоторое внимание, является разница в обработке омонимов. Вердоншот и др. исследовали различия во времени, необходимом для прочтения омонима вслух, когда перед символом предъявлялась картинка, связанная или не связанная с омонимом. Исследовались как японские, так и китайские омонимы. В то время как порождение слов в языках с алфавитным кодированием (таких как английский) продемонстрировало относительно устойчивый иммунитет к влиянию контекстных стимулов, Вердоншот и др. обнаружили, что японские омонимы особенно чувствительны к этим эффектам. В частности, время реакции было короче, когда участникам предъявляли фонологически связанную картинку перед тем, как их попросили прочитать целевой символ вслух. Примером фонологически связанного стимула в исследовании может служить, например, предъявление участникам изображения слона, которое на японском языке произносится как *дзоу*, перед предъявлением китайского иероглифа 造, который также читается как *дзоу*. Влияния фонологически связанных контекстных картинок на время реакции при чтении китайских слов обнаружено не было. Сравнение (частично) логографически закодированных языков японского и китайского интересно тем, что в то время как японский язык состоит более чем на 60% из гомографических гетерофонов (символов, которые можно прочитать двумя или более способами), большинство китайских иероглифов имеют только одно чтение. Поскольку оба языка кодируются логографически, разница в латентности при чтении вслух японского и китайского языков из-за контекстных эффектов не может быть объяснена логографической природой систем письма. Вместо этого авторы предполагают, что разница во времени задержки обусловлена дополнительными затратами на обработку в японском языке, где читатель не может полагаться исключительно на прямой путь от орфографии к фонологии, но также должен получить доступ к информации на лексико-синтаксическом уровне, чтобы выбрать правильное произношение. Эта гипотеза подтверждается исследованиями, показывающими, что японские пациенты с болезнью Альцгеймера, у которых ухудшилось понимание иероглифов, все же могли читать слова вслух без особых затруднений. Исследования, сопоставляющие обработку английских и китайских омонимов в задачах лексического решения, выявили преимущество при обработке омонимов в китайском языке и недостаток при обработке омонимов в английском языке. Недостаток обработки в английском языке обычно объясняется относительным недостатком омонимов в английском языке. Когда встречается омонимичное слово, сначала активируется его фонологическое представление. Однако, поскольку это неоднозначный стимул, необходимо сопоставление на орфографическом/лексическом ("ментальном словаре") уровне, прежде чем стимул можно будет однозначно определить и выбрать правильное произношение. Напротив, в языке (например, китайском), где существует множество символов с одинаковым чтением, предполагается, что читающий будет более знаком с омонимами, и это знакомство поможет в обработке символа и последующем выборе правильного произношения, что приведет к сокращению времени реакции при внимании к стимулу. В попытке лучше понять влияние омонимии на обработку, Хино и др. не обнаружили доказательств этого. Очевидно, что существует разница в том, как обрабатываются омонимы в языках с логографическим и алфавитным кодированием, но остается неясным, связано ли преимущество при обработке омонимов в логографически закодированных языках японском и китайском (то есть в их системах письма) с логографической природой письменности или же это просто отражает преимущество языков с большим количеством омонимов, независимо от природы письменности.
Разделение письма и произношения
Основное отличие логограмм от других систем письма заключается в том, что графемы не связаны напрямую с их произношением. Преимущество этого разделения состоит в том, что понимание произношения или языка автора не требуется, например, цифра 1 понимается независимо от того, как её называет читатель – «один», «ichi» или «wāḥid». Аналогично, люди, говорящие на разных диалектах китайского языка, могут не понимать друг друга в устной речи, но при этом в значительной степени понимать друг друга в письменной форме, даже если они не пишут на литературном китайском языке. Поэтому в Китае, Вьетнаме, Корее и Японии до современного периода общение посредством письма (筆談) было нормой в восточноазиатской международной торговле и дипломатии, используя классический китайский язык. Однако это разделение также имеет существенный недостаток – необходимость запоминания логограмм при обучении чтению и письму, отдельно от их произношения. Хотя это и не является неотъемлемой чертой логограмм, а обусловлено уникальной историей развития, японский язык имеет дополнительную сложность: почти каждая логограмма имеет более одного произношения. Напротив, фонетический набор знаков записывается точно так, как произносится, но с недостатком в том, что незначительные различия в произношении приводят к неоднозначности. Многие алфавитные системы, такие как греческая, латинская, итальянская, испанская и финская, представляют собой практический компромисс, сохраняя почти однозначное соответствие между знаками и звуками. Орфографии в некоторых других языках, таких как английский, французский, тайский и тибетский, более сложны: сочетания знаков часто произносятся по-разному, как правило, в зависимости от их истории. Хангыль, система письма корейского языка, является примером алфавитной письменности, разработанной для замены логограмматической ханчи с целью повышения грамотности населения. Последняя в настоящее время используется редко, но сохраняет определенное распространение в Южной Корее, иногда в сочетании с хангылем. Согласно исследованиям, заказанным правительством, наиболее часто используемые 3500 иероглифов, перечисленных в «Справочнике общеупотребительных иероглифов современного китайского языка» (现代汉语常用字表, Xiàndài Hànyǔ Chángyòngzì Biǎo) Китайской Народной Республики, охватывают 99,48% выборки из двух миллионов слов. Что касается традиционных китайских иероглифов, то 4808 иероглифов перечислены в «Справочнике стандартных форм общеупотребительных национальных иероглифов» (常用國字標準字體表) Министерства образования Республики Китай, а 4759 – в «Списке графем общеупотребительных китайских иероглифов» (常用字字形表) Бюро образования и трудовых ресурсов Гонконга, оба из которых предназначены для изучения в начальной и неполной средней школе. Образование после начальной школы включает не столько новых иероглифов, сколько новых слов, которые в основном представляют собой комбинации двух или более уже изученных иероглифов.
Персонажи в информационных технологиях
Ввод сложных символов может быть затруднительным на электронных устройствах из-за практического ограничения числа клавиш ввода. Существуют различные методы ввода логограмм, либо путем их разложения на составные части, как в методах Cangjie и Wubi для набора китайского текста, либо с использованием фонетических систем, таких как Bopomofo или Pinyin, где слово вводится по произношению, а затем выбирается из списка соответствующих логограмм. Первый метод (в линейном приближении) быстрее, но сложнее в освоении. В китайской системе, основанной на написании, штрихи, формирующие логограмму, вводятся в том порядке, в котором они обычно пишутся, после чего вводится соответствующий символ. Кроме того, из-за большого количества глифов, в программировании и вычислительной технике в целом, для хранения каждой графемы требуется больший объем памяти, поскольку набор символов более обширен. Для сравнения, ISO 8859 требует всего один байт на каждую графемы, в то время как Basic Multilingual Plane, закодированная в UTF-8, может требовать до трех байтов. С другой стороны, английские слова в среднем состоят из пяти символов и пробела, что требует шести байтов на слово. Поскольку многие логограммы содержат более одной графемы, неясно, какая система более экономична с точки зрения использования памяти. Кодировки переменной ширины позволяют единому стандарту кодирования символов, такому как Unicode, использовать только необходимое количество байтов для представления символа, снижая избыточность, возникающую при объединении больших и малых наборов символов.