Введение

Графема, представляющая слово или морфему.

В письменном языке логограмма (от древнегреческого logos — «слово» и gramma — «нарисованное или написанное»), также логограф или лексиграмма, — это письменный знак, представляющий смысловую единицу языка, такую как слово или морфема. Китайские иероглифы, используемые в китайском языке и других языках, являются логограммами, как и египетские иероглифы и знаки клинописного письма. Система письма, преимущественно использующая логограммы, называется логографией. Нелогографические системы письма, такие как алфавиты и слоговые системы, являются фонемическими: их отдельные знаки непосредственно представляют звуки и не имеют самостоятельного значения. Однако все известные логографии содержат определенный фонетический компонент, обычно основанный на принципе ребуса, и добавление фонетического компонента к чистым идеограммам считается ключевым нововведением, позволившим системе письма адекватно кодировать человеческий язык.

Классификация

Логографические системы включают в себя самые ранние системы письма; первые исторические цивилизации Месопотамии, Египта, Китая и Мезоамерики использовали ту или иную форму логографического письма. Все логографические письменности, когда-либо использовавшиеся для естественных языков, опираются на принцип ребуса для расширения относительно ограниченного набора логограмм: часть символов используется для обозначения их фонетических значений, будь то согласные или слоги. Термин «логосиллабарий» используется для подчеркивания частично фонетического характера этих письменностей, когда фонетической единицей является слог. В древнеегипетских иероглифах, письме ч’олти’ и китайском языке дополнительно развились детерминативы, которые сочетаются с логограммами для уточнения их возможного значения. В китайском языке они сливаются с логографическими элементами, используемыми фонетически; такие «радикально-фонетические» иероглифы составляют основную часть письменности. Древние египтяне и китайцы ограничили активное использование ребуса написанием иностранных слов и диалектизмов.

Логотипконсонантальный

В логоконсонантных системах письма графемы могут быть фонетически расширены в соответствии с согласными звуками тех слов, которые они представляют, игнорируя гласные. Например, египетский знак G38 использовался для записи слов sȝ «утка» и sȝ «сын», хотя, вероятно, эти слова произносились по-разному, за исключением совпадающих согласных. Основными примерами логоконсонантного письма являются египетские иероглифы, иератическое и демотическое письмо: древнеегипетский язык.

Логосиллабический

В логосиллабических системах письма графемы обозначают морфемы, часто полисиллабические, но при фонетическом расширении могут представлять отдельные слоги. К ним относятся клинопись, анатолийские иероглифы, критские иероглифы, линейное письмо А и линейное письмо Б, китайские иероглифы, письменность майя, ацтекская письменность, микстекская письменность и первые пять этапов письменности бамум.

Другие

Особая система логограмм, разработанная в рамках пехлеви (разработанная из арамейской абджады), использовалась для записи среднеперсидского языка на протяжении большей части сасанидского периода; логограммы составлялись из букв, которые записывали слово на арамейском языке, но произносились по-персидски (например, сочетание m l k произносилось как "шах"). Эти логограммы, известные как [[Frahang i Pahlavig] (являющиеся формой гетерограмм), полностью исчезли после арабского завоевания Персии и перехода на вариант арабского алфавита.

Семантические и фонетические измерения

Все исторические логографические системы включают в себя фонетический компонент, поскольку непрактично иметь отдельный базовый знак для каждого слова или морфемы в языке. В некоторых случаях, например, клинопись, использовавшаяся для аккадского языка, подавляющее большинство глифов используется для обозначения их звуковых значений, а не логографически. Многие логографические системы также имеют семантический/идеографический компонент (см. идеограмма), называемый "детерминативами" в египетском языке и "радикалами" в китайском языке. Типичный египетский способ заключался в том, чтобы дополнить логограмму, которая потенциально может представлять несколько слов с разным произношением, детерминативом для сужения значения и фонетическим компонентом для уточнения произношения. В китайском языке подавляющее большинство иероглифов представляет собой фиксированное сочетание радикала, указывающего на его номинальную категорию, и фонетического компонента, дающего представление о произношении. Система письма майя использовала логограммы с фонетическими дополнениями, подобно египетской, но без идеографических компонентов.

Китайские символы

Китайские ученые традиционно классифицируют китайские иероглифы (hànzì) на шесть типов по этимологии. Первые два типа – "одно тело", что означает, что иероглиф был создан независимо от других иероглифов. Пиктограммы и идеограммы типа "одно тело" составляют лишь небольшую долю китайских логограмм. Более продуктивными для китайской письменности были два "сложных" метода, то есть иероглиф создавался путем соединения различных иероглифов. Несмотря на название "сложные", эти логограммы остаются едиными иероглифами и занимают столько же места, сколько любой другой логограмм. Последние два типа – это методы использования иероглифов, а не их формирования. Первый тип, наиболее часто ассоциирующийся с китайской письменностью, – это пиктограммы, являющиеся изобразительными представлениями морфемы, например, 山 для 'горы'. Второй тип – это идеограммы, которые пытаются визуализировать абстрактные понятия, такие как 上 'вверх' и 下 'вниз'. Также к идеограммам относятся пиктограммы с идеографическим показателем; например, 刀 – пиктограмма, означающая 'нож', а 刃 – идеограмма, означающая 'лезвие'. Составные радикально-радикальные иероглифы, в которых каждый элемент иероглифа (называемый радикалом) намекает на его значение. Например, 休 'отдых' состоит из иероглифов для 'человек' (人) и 'дерево' (木), с подразумеваемой идеей человека, опирающегося на дерево, то есть отдыхающего. Составные радикально-фонетические иероглифы, в которых один компонент (радикал) указывает на общее значение иероглифа, а другой (фонетический) намекает на произношение. Примером является 樑 (liáng), где фонетический 梁 liáng указывает на произношение иероглифа, а радикальный 木 ('дерево') – на его значение 'подпорная балка'. Иероглифы этого типа составляют около 90% китайских логограмм. Измененные иероглифы-аннотации – это иероглифы, которые изначально были одним и тем же иероглифом, но разделились в результате орфографического и часто семантического сдвига. Например, 樂 / 乐 может означать и 'музыку' (yuè), и 'удовольствие' (lè). Импровизированные иероглифы (лит. 'импровизированные заимствованные слова') появляются, когда для родного слова нет соответствующего иероглифа, и поэтому "заимствуется" другой иероглиф с тем же или похожим звучанием (и часто близким значением); иногда новое значение может вытеснить старое. Например, 自 раньше было пиктографическим словом, означающим 'нос', но было заимствовано для обозначения 'я', и теперь используется почти исключительно в этом значении; первоначальное значение сохранилось только в устойчивых выражениях и более архаичных соединениях. В силу своего процесса образования, весь набор японских кана можно считать иероглифами этого типа, отсюда и название кана (лит. 'заимствованные имена'). Пример: японский 仮名; 仮 – упрощенная форма китайского 假, используемая в Корее и Японии, а 假借 – китайское название для этого типа иероглифов. Наиболее продуктивный метод китайской письменности, радикально-фонетический, стал возможен благодаря игнорированию определенных различий в фонетической системе слогов. В древнекитайском языке конечные согласные и обычно игнорировались; они превратились в тоны в среднекитайском языке, которые также игнорировались при создании новых иероглифов. Также игнорировались различия в аспирации (между придыхательными и непридыхательными согласными, и звонкими и глухими сонантами); различие между слогами типа А и типа В в древнекитайском языке (часто описываемое как наличие и отсутствие палатализации или фарингализации); и иногда, звонкость начальных согласных и/или наличие медиального после начального согласного. В более ранние времена допускалась большая фонетическая свобода. В среднекитайский период вновь созданные иероглифы, как правило, точно соответствовали произношению, за исключением тона, – часто используя в качестве фонетического компонента иероглиф, который сам является радикально-фонетическим соединением. Из-за длительного периода эволюции языка такие компоненты-"подсказки" в иероглифах, предоставляемые радикально-фонетическими соединениями, иногда бесполезны и могут вводить в заблуждение в современном использовании. Например, на основе 每 'каждый', произносится měi в стандартном мандаринском диалекте, находятся иероглифы 侮 'унижать', 悔 'сожалеть' и 海 'море', произносимые соответственно wǔ, huǐ и hǎi в мандаринском диалекте. Три из этих иероглифов произносились очень похоже в древнекитайском языке – (每), (悔) и (海) согласно недавней реконструкции Уильяма Х. Бакстера и Лорана Сагара – но изменения в произношении за прошедшие примерно 3000 лет (включая два различных диалектальных развития, в случае последних двух иероглифов) привели к радикально различающемуся произношению.

Китайские символы, используемые в японском и корейском языках

В контексте китайского языка китайские иероглифы (известные как ханьцзы) в основном представляют слова и морфемы, а не абстрактные понятия; однако заимствование китайских иероглифов японским и корейским языками (где они известны как кандзи и ханджа соответственно) внесло некоторые сложности в эту картину. Многие китайские слова, состоящие из китайских морфем, были заимствованы в японский и корейский языки вместе с их иероглифическим написанием; в этом случае морфемы и иероглифы заимствовались одновременно. Однако в других случаях иероглифы заимствовались для обозначения исконных японских и корейских морфем, исключительно на основе значения. В результате один и тот же иероглиф может оказаться обозначающим несколько морфем с близким значением, но разным происхождением в разных языках. По этой причине кандзи и ханджа иногда описываются как морфографические системы письма.

Различия в обработке логографических и фонологических систем письма

Поскольку значительная часть исследований обработки языка была сосредоточена на английском и других языках с алфавитным письмом, многие теории обработки языка подчеркивали роль фонологии в порождении речи. Сопоставление языков с логографическим кодированием, где один символ представлен как фонетически, так и идеографически, с языками, в которых используется фонетическое/фонемное написание, позволило получить представление о том, как различные языки опираются на разные механизмы обработки. Исследования обработки языков с логографическим кодированием, в частности, изучали нейробиологические различия в обработке, при этом одной из областей особого интереса является полушарная латерализация. Поскольку языки с логографическим кодированием теснее связаны с образами, чем языки с алфавитным кодированием, ряд исследователей предположили, что активация правого полушария должна быть более выраженной в языках с логографическим кодированием. Хотя некоторые исследования дали результаты, согласующиеся с этой гипотезой, существует слишком много противоречивых результатов, чтобы делать какие-либо окончательные выводы о роли полушарной латерализации в языках с орфографическим и фонетическим кодированием. Другой темой, получившей некоторое внимание, является разница в обработке омонимов. Вердоншот и др. исследовали различия во времени, необходимом для прочтения омонима вслух, когда перед символом предъявлялась картинка, связанная или не связанная с омонимом. Исследовались как японские, так и китайские омонимы. В то время как порождение слов в языках с алфавитным кодированием (таких как английский) продемонстрировало относительно устойчивый иммунитет к влиянию контекстных стимулов, Вердоншот и др. обнаружили, что японские омонимы особенно чувствительны к этим эффектам. В частности, время реакции было короче, когда участникам предъявляли фонологически связанную картинку перед тем, как их попросили прочитать целевой символ вслух. Примером фонологически связанного стимула в исследовании может служить, например, предъявление участникам изображения слона, которое на японском языке произносится как *дзоу*, перед предъявлением китайского иероглифа 造, который также читается как *дзоу*. Влияния фонологически связанных контекстных картинок на время реакции при чтении китайских слов обнаружено не было. Сравнение (частично) логографически закодированных языков японского и китайского интересно тем, что в то время как японский язык состоит более чем на 60% из гомографических гетерофонов (символов, которые можно прочитать двумя или более способами), большинство китайских иероглифов имеют только одно чтение. Поскольку оба языка кодируются логографически, разница в латентности при чтении вслух японского и китайского языков из-за контекстных эффектов не может быть объяснена логографической природой систем письма. Вместо этого авторы предполагают, что разница во времени задержки обусловлена дополнительными затратами на обработку в японском языке, где читатель не может полагаться исключительно на прямой путь от орфографии к фонологии, но также должен получить доступ к информации на лексико-синтаксическом уровне, чтобы выбрать правильное произношение. Эта гипотеза подтверждается исследованиями, показывающими, что японские пациенты с болезнью Альцгеймера, у которых ухудшилось понимание иероглифов, все же могли читать слова вслух без особых затруднений. Исследования, сопоставляющие обработку английских и китайских омонимов в задачах лексического решения, выявили преимущество при обработке омонимов в китайском языке и недостаток при обработке омонимов в английском языке. Недостаток обработки в английском языке обычно объясняется относительным недостатком омонимов в английском языке. Когда встречается омонимичное слово, сначала активируется его фонологическое представление. Однако, поскольку это неоднозначный стимул, необходимо сопоставление на орфографическом/лексическом ("ментальном словаре") уровне, прежде чем стимул можно будет однозначно определить и выбрать правильное произношение. Напротив, в языке (например, китайском), где существует множество символов с одинаковым чтением, предполагается, что читающий будет более знаком с омонимами, и это знакомство поможет в обработке символа и последующем выборе правильного произношения, что приведет к сокращению времени реакции при внимании к стимулу. В попытке лучше понять влияние омонимии на обработку, Хино и др. не обнаружили доказательств этого. Очевидно, что существует разница в том, как обрабатываются омонимы в языках с логографическим и алфавитным кодированием, но остается неясным, связано ли преимущество при обработке омонимов в логографически закодированных языках японском и китайском (то есть в их системах письма) с логографической природой письменности или же это просто отражает преимущество языков с большим количеством омонимов, независимо от природы письменности.

Разделение письма и произношения

Основное отличие логограмм от других систем письма заключается в том, что графемы не связаны напрямую с их произношением. Преимущество этого разделения состоит в том, что понимание произношения или языка автора не требуется, например, цифра 1 понимается независимо от того, как её называет читатель – «один», «ichi» или «wāḥid». Аналогично, люди, говорящие на разных диалектах китайского языка, могут не понимать друг друга в устной речи, но при этом в значительной степени понимать друг друга в письменной форме, даже если они не пишут на литературном китайском языке. Поэтому в Китае, Вьетнаме, Корее и Японии до современного периода общение посредством письма (筆談) было нормой в восточноазиатской международной торговле и дипломатии, используя классический китайский язык. Однако это разделение также имеет существенный недостаток – необходимость запоминания логограмм при обучении чтению и письму, отдельно от их произношения. Хотя это и не является неотъемлемой чертой логограмм, а обусловлено уникальной историей развития, японский язык имеет дополнительную сложность: почти каждая логограмма имеет более одного произношения. Напротив, фонетический набор знаков записывается точно так, как произносится, но с недостатком в том, что незначительные различия в произношении приводят к неоднозначности. Многие алфавитные системы, такие как греческая, латинская, итальянская, испанская и финская, представляют собой практический компромисс, сохраняя почти однозначное соответствие между знаками и звуками. Орфографии в некоторых других языках, таких как английский, французский, тайский и тибетский, более сложны: сочетания знаков часто произносятся по-разному, как правило, в зависимости от их истории. Хангыль, система письма корейского языка, является примером алфавитной письменности, разработанной для замены логограмматической ханчи с целью повышения грамотности населения. Последняя в настоящее время используется редко, но сохраняет определенное распространение в Южной Корее, иногда в сочетании с хангылем. Согласно исследованиям, заказанным правительством, наиболее часто используемые 3500 иероглифов, перечисленных в «Справочнике общеупотребительных иероглифов современного китайского языка» (现代汉语常用字表, Xiàndài Hànyǔ Chángyòngzì Biǎo) Китайской Народной Республики, охватывают 99,48% выборки из двух миллионов слов. Что касается традиционных китайских иероглифов, то 4808 иероглифов перечислены в «Справочнике стандартных форм общеупотребительных национальных иероглифов» (常用國字標準字體表) Министерства образования Республики Китай, а 4759 – в «Списке графем общеупотребительных китайских иероглифов» (常用字字形表) Бюро образования и трудовых ресурсов Гонконга, оба из которых предназначены для изучения в начальной и неполной средней школе. Образование после начальной школы включает не столько новых иероглифов, сколько новых слов, которые в основном представляют собой комбинации двух или более уже изученных иероглифов.

Персонажи в информационных технологиях

Ввод сложных символов может быть затруднительным на электронных устройствах из-за практического ограничения числа клавиш ввода. Существуют различные методы ввода логограмм, либо путем их разложения на составные части, как в методах Cangjie и Wubi для набора китайского текста, либо с использованием фонетических систем, таких как Bopomofo или Pinyin, где слово вводится по произношению, а затем выбирается из списка соответствующих логограмм. Первый метод (в линейном приближении) быстрее, но сложнее в освоении. В китайской системе, основанной на написании, штрихи, формирующие логограмму, вводятся в том порядке, в котором они обычно пишутся, после чего вводится соответствующий символ. Кроме того, из-за большого количества глифов, в программировании и вычислительной технике в целом, для хранения каждой графемы требуется больший объем памяти, поскольку набор символов более обширен. Для сравнения, ISO 8859 требует всего один байт на каждую графемы, в то время как Basic Multilingual Plane, закодированная в UTF-8, может требовать до трех байтов. С другой стороны, английские слова в среднем состоят из пяти символов и пробела, что требует шести байтов на слово. Поскольку многие логограммы содержат более одной графемы, неясно, какая система более экономична с точки зрения использования памяти. Кодировки переменной ширины позволяют единому стандарту кодирования символов, такому как Unicode, использовать только необходимое количество байтов для представления символа, снижая избыточность, возникающую при объединении больших и малых наборов символов.