Введение
Модификаторный знак, добавленный к букве.
Диакритический знак (также диакритикум, диакритическая точка, диакритический знак или акцент) — это глиф, добавляемый к букве или базовому глифу. Термин происходит от древнегреческого διακριτικός (diakritikós, «различительный»), от διακρίνω (diakrínō, «различать»). Слово «диакритический» — существительное, хотя иногда используется в атрибутивном значении, в то время как «диакритикум» — только прилагательное. Некоторые диакритические знаки, такие как острый, гравис и циркумфлекс (все показаны над буквой ‘a’), часто называются акцентами. Диакритические знаки могут располагаться над или под буквой, либо в другом месте, например, внутри буквы или между двумя буквами. Основное назначение диакритических знаков в латинском алфавите — изменение звукового значения букв, к которым они добавляются. Исторически английский язык использовал диаэрезу для указания правильного произношения неоднозначных слов, таких как "coöperate", без которой последовательность букв <oo> могла бы быть неправильно истолкована. Другие примеры — острый и гравис, которые могут указывать на то, что гласный следует произносить иначе, чем обычно в данной позиции, например, не редуцировать до /ə/ или не делать его немым, как в случае двух употреблений буквы e в существительном "résumé" (в отличие от глагола "resume"), а также помощь, иногда оказываемая в произношении некоторых слов, таких как "doggèd", "learnèd", "blessèd", и особенно слов, произносимых иначе, чем обычно, в поэзии (например, "movèd", "breathèd"). Большинство других слов с диакритическими знаками в английском языке — заимствования из языков, таких как французский, для лучшего сохранения орфографии, например, диаэреза в "naïve" и "Noël", острый акцент в "café", циркумфлекс в слове "crêpe" и седиль в "façade". Однако все эти диакритические знаки часто опускаются при письме, и английский язык — единственный крупный современный европейский язык, в котором диакритические знаки не используются повсеместно. В латинских алфавитах других языков диакритические знаки могут различать омонимы, например, французские "là" ("там") и "la" ("the"), которые оба произносятся одинаково. В гэльском шрифте точка над согласной указывает на смягчение этой согласной. В других системах письма диакритические знаки могут выполнять и другие функции. Системы гласных указателей, а именно арабские харакаты (ـِ, ـُ, ـَ и т. д.) и еврейские никкуды (ַ◌, ֶ◌, ִ◌, ֹ◌, ֻ◌ и т. д.), обозначают гласные, которые не передаются основным алфавитом. Индийская вирама (्) и арабский сукун (ـْـ) обозначают отсутствие гласных. Знаки кантилляции указывают на просодию. Другие примеры включают ранний кириллический титло (◌҃) и еврейский гершаим (״), которые соответственно обозначают сокращения или аббревиатуры, а также греческие диакритические знаки, которые показывали, что буквы алфавита использовались в качестве чисел. Во вьетнамском и ханьюй пиньине, официальной системе романизации китайского языка, диакритические знаки используются для обозначения тонов слогов, в которых встречаются отмеченные гласные. В орфографии и коллации буква, модифицированная диакритическим знаком, может рассматриваться либо как новая, отдельная буква, либо как комбинация буквы и диакритического знака. Это зависит от языка и может варьироваться в зависимости от случая в пределах языка. В некоторых случаях буквы используются как «встроенные диакритические знаки», выполняющие ту же функцию, что и вспомогательные глифы, поскольку они изменяют звук предшествующей буквы, как в случае буквы "h" в английском произношении "sh" и "th". Такие буквенные сочетания иногда даже объединяются в одну отдельную букву. Например, написание "sch" традиционно часто рассматривалось как отдельная буква в немецком языке. Слова с таким написанием перечислялись после всех остальных слов, написанных с буквой "s" в карточных каталогах венских публичных библиотек, например (до оцифровки).
Корейский
Диакритические знаки 〮 и 〯, известные как Bangjeom (방점; 傍點), использовались для обозначения тоновых акцентов в хангыле для среднекорейского языка. Они писались слева от слога при вертикальном письме и над слогом при горизонтальном письме.
Неалфавитные письма
Некоторые неалфавитные системы письма также используют символы, которые по сути выполняют функцию диакритических знаков. Нечистые абджады (такие как иврит и арабское письмо) и абугиды используют диакритические знаки для обозначения гласных. Иврит и арабский также указывают удвоение согласных и их изменения с помощью диакритических знаков; иврит и деванагари используют их для обозначения иноязычных звуков. Деванагари и связанные с ним абугиды также используют диакритический знак, называемый вирама, для обозначения отсутствия гласного. Кроме того, в деванагари используется лунный знак чандрабинду ( ँ ) для обозначения назализации гласных. В унифицированной канадской слоговой письменности используются несколько типов диакритических знаков, включая диакритические знаки с алфавитными свойствами, известные как медиалы и финалы. Изначально долгота гласных обозначалась горизонтальной линией, пересекающей слоговой глиф, делая его прерывистым, но в современных формах для обозначения долготы гласного используется точка над глифом. В некоторых стилях кольцо над глифом указывает на долгий гласный с последующим звуком [j]. Другой диакритический знак, "внутреннее кольцо", помещается в верхней части глифа для изменения звука [p] на [f] и [t] на [θ]. Медиалы, такие как "точка w", расположенная рядом со слоговым глифом, указывают на вставку звука [w] между начальным согласным слога и гласным. Финалы обозначают согласный слогового коду; некоторые согласные слогового коду в середине слова, например, с "h-чертой", указывают на усиление согласного в следующем слоге. Японские слоговые азбуки хирагана и катакана используют символы дакутен (◌゛) и хандакутен (◌゜) (в японском языке: 濁点 и 半濁点), также известные как нигори (濁 "замутнение") или тэн-тэн (点々 "точка-точка") и мару (丸 "круг"), для обозначения звонких согласных или других фонетических изменений. Эмотиконы часто создаются с использованием диакритических символов, особенно японские эмотиконы на популярных имиджбордах.
Алфавитное распределение или сбор
Разные языки используют разные правила для упорядочения диакритических символов в алфавите. Французский и португальский языки при упорядочивании и в словарях рассматривают буквы с диакритическими знаками так же, как и базовые буквы. Скандинавские языки и финский язык, напротив, рассматривают символы å, ä и ö с диакритическими знаками как отдельные буквы алфавита и располагают их после z. Обычно ä (умлаут a) и ö (умлаут o) [используемые в шведском и финском языках] упорядочиваются как эквиваленты æ (ash) и ø (o slash) [используемые в датском и норвежском языках]. Кроме того, aa, когда используется как альтернативное написание å, упорядочивается соответствующим образом. Другие буквы, модифицированные диакритическими знаками, рассматриваются как варианты базовой буквы, за исключением того, что ü часто упорядочивается как y. Языки, рассматривающие гласные с ударениями как варианты базовых букв, обычно располагают слова с такими символами сразу после аналогичных слов без ударения. Например, в немецком языке, если два слова отличаются только умлаутом, слово без него располагается первым в немецких словарях (например, schon, а затем schön, или fallen, а затем fällen). Однако, когда речь идет об именах (например, в телефонных справочниках или каталогах авторов в библиотеках), умлауты часто рассматриваются как сочетание гласной с последующим e; австрийские телефонные справочники теперь рассматривают символы с умлаутами как отдельные буквы (непосредственно после базовой гласной). В испанском языке графема ñ считается отдельной буквой, отличной от n, и располагается между n и o, поскольку она обозначает звук, отличный от звука простой n. Но гласные с ударениями á, é, í, ó, ú не отделяются от гласных без ударения a, e, i, o, u, поскольку острое ударение в испанском языке лишь изменяет ударение в слове или различает омонимы, но не изменяет звук буквы. Подробный список правил упорядочивания в разных языках можно найти в статье «Порядок сортировки».
Выработка с помощью компьютеров
Современные компьютерные технологии были разработаны преимущественно в англоязычных странах, поэтому форматы данных, раскладки клавиатуры и т. д. были созданы с учётом особенностей английского языка – языка с алфавитом, не содержащим диакритических знаков. Предпринимались попытки создания интернационализированных доменных имён, расширяющих английский алфавит (например, "pokémon.com"). В зависимости от раскладки клавиатуры, которая различается в разных странах, вводить буквы с диакритическими знаками на компьютерах и пишущих машинках бывает легче или сложнее. Для некоторых знаков предусмотрены отдельные клавиши, для других – необходимо сначала нажать клавишу с диакритическим знаком, а затем – букву. Такие клавиши иногда называют "мёртвыми", поскольку сами по себе они не выводят никакого символа, а лишь модифицируют следующий нажатый символ. В современных операционных системах Microsoft Windows и Linux раскладки US International и UK International используют "мёртвые" клавиши, позволяющие напрямую вводить латинские буквы с острым ударением, грависом, циркумфлексом, диэрезисом/умлаутом, тильдой и цедильей, используемыми в западноевропейских языках (в частности, комбинации, входящие в набор символов ISO Latin 1): + даёт ë, + даёт õ и т. д. На компьютерах Apple Macintosh предусмотрены сочетания клавиш для наиболее распространённых диакритических знаков: + гласная даёт острый акцент, + гласная даёт умлаут, + даёт цедилью и т. д. Диакритические знаки можно составлять в большинстве раскладок клавиатуры X Window System, а также в других операционных системах, таких как Microsoft Windows, с помощью дополнительного программного обеспечения. На компьютерах возможность использования определённых диакритических знаков определяется наличием кодовых страниц. Unicode решает эту проблему, присваивая каждому известному символу уникальный код; если этот код известен, большинство современных компьютерных систем предоставляют способ его ввода. Unicode также позволяет комбинировать диакритические знаки с большинством символов. Однако, по состоянию на 2019 год, очень мало шрифтов поддерживают корректное отображение символа вместе с диакритическими знаками для латинского, кириллического и некоторых других алфавитов (исключение составляет шрифт Andika).
Языки с буквами, содержащими диакритические знаки
В следующих языках существуют буквы с диакритическими знаками, которые орфографически различаются с буквами без диакритических знаков.
Кельтский язык
В валлийском языке используются оборотный, диаэрезис, острый и гравис акценты над семью гласными a, e, i, o, u, w, y (отсюда и составные â, ê, î, ô, û, ŵ, ŷ, ä, ë, ï, ö, ü, ẅ, ÿ, á, é, í, ó, ú, ẃ, ý, à, è, ì, ò, ù, ẁ, ỳ). Однако все, кроме оборотного акцента (который используется как макро́н), довольно редки. После орфографических реформ, начавшихся в 1970-х годах, шотландский гэльский использует только гравис, который может быть поставлен над любой гласной (à, è, ì, ò, ù). Ранее острые акценты могли использоваться над á, ó и é, чтобы указать на определенное качество гласного. С отменой этих акцентов, новая орфография предполагает, что читатель уже знаком с произношением данного слова. Мэнский язык использует единственный диакритический знак ç в сочетании с h, образуя диграф (произносится как ) для обозначения различия между ним и диграфом (произносится как или ). Другие диакритические знаки, используемые в мэнском языке, включают â, ê, ï и т. д. для различения двух слов с одинаковым написанием, но немного отличающимся произношением. Ирландский язык использует только острые акценты для обозначения долгих гласных, согласно орфографической реформе 1948 года. Лениция обозначается точкой над буквой в гэльском шрифте: в римском шрифте используется суффикс. Бретонский язык не имеет единой орфографии (системы написания), но использует диакритические знаки для различных целей. Диаэрезис используется для обозначения того, что две гласные произносятся раздельно, а не как дифтонг/диграф. Оборотный акцент используется для обозначения долгих гласных, но обычно только тогда, когда долгота гласного не предсказуема по фонетике. Назализация гласных может быть обозначена тильдой или буквой <ñ>, следующей за гласной. Множественный суффикс où используется в качестве унифицированного написания для обозначения суффикса с различными произношениями в разных диалектах и для отличия этого суффикса от диграфа <ou>, который произносится как . Апостроф используется для различения c'h, произносимого как , от французского влияния на диграф ch, произносимого как , который используется в других кельтских языках как диграф <ch>.
Финно-угорский
В эстонском языке есть особая буква õ, содержащая тильду. Эстонские "точечные гласные" ä, ö, ü похожи на немецкие, но это также отдельные буквы, а не немецкие гласные с умлаутом. Все четыре имеют своё место в алфавите, между w и x. Знаки карона над š или ž встречаются только в иностранных собственных именах и заимствованиях. Это также отдельные буквы, расположенные в алфавите между s и t. Финский язык использует точечные (умлаутированные) гласные (ä и ö). Как и в шведском и эстонском языках, они считаются отдельными буквами, а не комбинацией гласной и умлаута (как в немецком языке). Он также использует символы å, š и ž в иностранных именах и заимствованиях. В финском и шведском алфавитах å, ä и ö располагаются как отдельные буквы после z, остальные – как варианты основных букв. Венгерский язык использует умлаут, острое и двойное острое ударение (уникальное для венгерского языка): (ö, ü), (á, é, í, ó, ú) и (ő, ű). Острое ударение указывает на долгую форму гласной (в случае i/í, o/ó, u/ú), а двойное острое выполняет ту же функцию для ö и ü. Острое ударение может также указывать на другой звук (более открытый, как в случае a/á, e/é). И длинные, и короткие формы гласных перечислены отдельно в венгерском алфавите, но члены пар a/á, e/é, i/í, o/ó, ö/ő, u/ú и ü/ű в словарях рассматриваются как одна и та же буква. Ливский язык использует следующие буквы: ā, ä, ǟ, ḑ, ē, ī, ļ, ņ, ō, ȯ, ȱ, õ, ȭ, ŗ, š, ț, ū, ž.
Finnish uses dotted (umlauted) vowels (ä and ö). As in Swedish and Estonian, these are regarded as individual letters, rather than vowel + umlaut combinations (as happens in German). It also uses the characters å, š and ž in foreign names and loanwords. In the Finnish and Swedish alphabets, å, ä and ö collate as separate letters after z, the others as variants of their base letter. Hungarian uses the umlaut, the acute and double acute accent (unique to Hungarian): (ö, ü), (á, é, í, ó, ú) and (ő, ű). The acute accent indicates the long form of a vowel (in case of i/í, o/ó, u/ú) while the double acute performs the same function for ö and ü. The acute accent can also indicate a different sound (more open, like in case of a/á, e/é). Both long and short forms of the vowels are listed separately in the Hungarian alphabet, but members of the pairs a/á, e/é, i/í, o/ó, ö/ő, u/ú and ü/ű are collated in dictionaries as the same letter. Livonian has the following letters: ā, ä, ǟ, ḑ, ē, ī, ļ, ņ, ō, ȯ, ȱ, õ, ȭ, ŗ, š, ț, ū, ž.
Германский
Немецкий язык использует умлаут: буквы, используемые для обозначения продвижения задних гласных вперёд. В голландском языке используются диакритические знаки – острый, циркумфлекс, гравис и диаэрезис – с большинством гласных и цедилья с «c», как и во французском языке. В результате получаются á, à, ä, é, è, ê, ë, í, î, ï, ó, ô, ö, ú, û, ü и ç. Это в основном слова (и имена), происходящие из французского языка (например, crème, café, gêne, façade). Острый акцент также используется для выделения гласного (как één). Диакритический знак, состоящий из двух точек, используется как диаэрезис (обозначающий гласный разрыв, разделяющий два гласных, например, reële, reünie, coördinatie), а не для обозначения умлаута, как в немецком языке. В африкаанс используется 16 дополнительных гласных, как в верхнем, так и в нижнем регистре: á, ä, é, è, ê, ë, í, î, ï, ʼn, ó, ô, ö, ú, û, ü, ý. Фарерский язык использует острые знаки и другие специальные буквы. Все они считаются отдельными буквами и имеют своё место в алфавите: á, í, ó, ú, ý и ø. Исландский язык использует острые знаки и другие специальные буквы. Все они считаются отдельными буквами и имеют своё место в алфавите: á, é, í, ó, ú, ý и ö. Датский и норвежский языки используют дополнительные символы, такие как o с перечеркиванием ø и a с кольцем å. Эти буквы следуют за z и æ в порядке ø, å. Исторически å развился из лигатуры, когда над строчной a писалась маленькая надстрочная a; если символ å недоступен, некоторые скандинавские языки допускают замену двойной a. Скандинавские языки располагают эти буквы после z, но используют разные стандарты сортировки. Шведский язык использует диаэрезис (ä) и o с диаэрезисом (ö) вместо ash (æ) и перечеркнутого o (ø) в дополнение к a с кольцом (å). Исторически диаэрезис для шведских букв ä и ö, как и немецкий умлаут, развился из маленькой готической e, написанной над буквами. Эти буквы располагаются после z, в порядке å, ä, ö.
Faroese uses acutes and other special letters. All are considered separate letters and have their own place in the alphabet: á, í, ó, ú, ý and ø.
Icelandic uses acutes and other special letters. All are considered separate letters, and have their own place in the alphabet: á, é, í, ó, ú, ý, and ö.
Danish and Norwegian use additional characters like the o slash ø and the a overring å. These letters come after z and æ in the order ø, å. Historically, the å has developed from a ligature by writing a small superscript a over a lowercase a; if an å character is unavailable, some Scandinavian languages allow the substitution of a doubled a. The Scandinavian languages collate these letters after z, but have different collation standards. Swedish uses a diaeresis (ä) and o diaeresis (ö) in the place of ash (æ) and slashed o (ø) in addition to the a overring (å). Historically, the diaeresis for the Swedish letters ä and ö, like the German umlaut, developed from a small Gothic e written above the letters. These letters are collated after z, in the order å, ä, ö.
Славянский
Хорватский алфавит содержит символы č, ć, đ, š и ž, которые считаются отдельными буквами и перечисляются как таковые в словарях и других контекстах, где слова располагаются в алфавитном порядке. Он также включает один диграф с диакритическим знаком – dž, который также упорядочивается независимо и следует за d и предшествует đ в алфавитном порядке. В чешском алфавите используются острый акцент (á é í ó ú ý), хачек (č ď ě ň ř š ť ž) и кольцо для одной буквы (ů). (В ď и ť хачек модифицирован и выглядит скорее как апостроф.) Буквы с хачеком считаются отдельными буквами, тогда как гласные рассматриваются лишь как более длинные варианты букв без диакритических знаков. Острый акцент не влияет на алфавитный порядок, а буквы с хачеком располагаются после своих оригинальных аналогов. Польский алфавит использует следующие буквы: ą ć ę ł ń ó ś ź ż. Все они считаются отдельными буквами: каждая из них помещается в алфавит сразу после соответствующей латинской буквы (например, ą между a и b), а ź и ż – после z в указанном порядке. Сербский кириллический алфавит не имеет диакритических знаков, вместо этого для каждой буквы хорватского аналога (включая хорватские буквы с диакритическими знаками и диграфы dž, lj и nj) используется отдельная графема (глиф). Словацкий алфавит использует острый акцент (á é í ó ú ý ĺ ŕ), хачек (č ď ľ ň š ť ž dž), умлаут (ä) и циркумфлекс (ô). Все эти знаки считаются отдельными буквами и располагаются непосредственно после оригинального аналога в алфавите. Основной словенский алфавит содержит символы č, š и ž, которые считаются отдельными буквами и перечисляются как таковые в словарях и других контекстах, где слова располагаются в алфавитном порядке. Буквы с хачеком располагаются сразу после букв без диакритического знака. Буква đ может использоваться в не транслитерированных заимствованиях, особенно в именах собственных, и располагается после č и перед d.
Турки
Азербайджанский язык включает в себя отдельные буквы турецкого алфавита Ç, Ğ, I, İ, Ö, Ş и Ü. Крымскотатарский язык включает в себя отдельные буквы турецкого алфавита Ç, Ğ, I, İ, Ö, Ş и Ü. В отличие от турецкого, крымскотатарский язык также имеет букву Ñ. Гагаузский язык включает в себя отдельные буквы турецкого алфавита Ç, Ğ, I, İ, Ö и Ü. В отличие от турецкого языка, гагаузский язык также имеет буквы Ä, Ê, Ș и Ț. Буквы Ș и Ț заимствованы из румынского алфавита для обозначения тех же звуков. Иногда вместо Ș может использоваться турецкий Ş. Турецкий язык использует G с бреве (Ğ), две буквы с умлаутом (Ö и Ü, обозначающие два округленных передних гласных), две буквы с седилью (Ç и Ş, обозначающие аффрикату и фрикатив), а также заглавную İ с точкой (и строчную ı без точки, обозначающую высокий нелабиализованный задний гласный). В турецком языке каждая из этих букв является самостоятельной, а не вариантом другой буквы, при этом заглавная İ с точкой и строчная i – это одна и та же буква, как и заглавная I без точки и строчная ı. С типографской точки зрения, Ç и Ş иногда отображаются с подточечной диакритикой, как в Ṣ; при использовании крючка он обычно имеет форму запятой, а не традиционной седильи. Новые азербайджанский, крымскотатарский и гагаузский алфавиты основаны на турецком алфавите и его диакритических буквах с некоторыми дополнениями. Туркменский язык использует отдельные буквы турецкого алфавита Ç, Ö, Ş и Ü. Кроме того, туркменский язык использует A с диаэрезой (Ä) для обозначения , N с гачеком (Ň) для обозначения велярного носового согласного, Y с акутом (Ý) для обозначения палатализованного аппроксиманта, и Z с гачеком (Ž) для обозначения .
Crimean Tatar includes the distinct Turkish alphabet letters Ç, Ğ, I, İ, Ö, Ş and Ü. Unlike Turkish, Crimean Tatar also has the letter Ñ.
Gagauz includes the distinct Turkish alphabet letters Ç, Ğ, I, İ, Ö and Ü. Unlike Turkish, Gagauz also has the letters Ä, Ê Ș and Ț. Ș and Ț are derived from the Romanian alphabet for the same sounds. Sometime the Turkish Ş may be used instead of Ș.
Turkish uses a G with a breve (Ğ), two letters with an umlaut (Ö and Ü, representing two rounded front vowels), two letters with a cedilla (Ç and Ş, representing the affricate and the fricative ), and also possesses a dotted capital İ (and a dotless lowercase ı representing a high unrounded back vowel). In Turkish each of these are separate letters, rather than versions of other letters, where dotted capital İ and lower case i are the same letter, as are dotless capital I and lowercase ı. Typographically, Ç and Ş are sometimes rendered with a subdot, as in Ṣ; when a hook is used, it tends to have more a comma shape than the usual cedilla. The new Azerbaijani, Crimean Tatar, and Gagauz alphabets are based on the Turkish alphabet and its same diacriticized letters, with some additions. Turkmen includes the distinct Turkish alphabet letters Ç, Ö, Ş and Ü. In addition, Turkmen uses A with diaeresis (Ä) to represent , N with caron (Ň) to represent the velar nasal , Y with acute (Ý) to represent the palatal approximant , and Z with caron (Ž) to represent .
Другое
В албанском языке есть две специальные буквы Ç и Ë, в верхнем и нижнем регистре. Они расположены рядом с наиболее похожими буквами в алфавите, соответственно с буквами c и e. В эсперанто используются символы ŭ, ĉ, ĝ, ĥ, ĵ и ŝ, которые включены в алфавит и считаются отдельными буквами. В филиппинском языке также есть символ ñ, используемый как буква, и он располагается между n и o. В современном гренландском языке не используются диакритические знаки, хотя ø и å применяются для написания заимствованных слов, особенно из датского и английского языков. С 1851 по 1973 год гренландский язык писался алфавитом, изобретенным Сэмюэлем Клейншмидтом, в котором длинные гласные и долготные согласные обозначались диакритическими знаками над гласными (в случае долготного согласного, диакритические знаки ставились над гласной, предшествующей этому согласной). Например, название Калааллит Нунаат писалось Kalâdlit Nunât. В этой схеме используется циркумфлекс (◌̂) для обозначения долгой гласной (например, ; современный: ), акут (◌́) для обозначения долготности следующего согласного (например, ; современный: ) и, наконец, тильда (◌̃) или гравис (◌̀), в зависимости от автора, для обозначения длительности гласной и долготности следующего согласного (например, ; современный: ). , используемые только ранее, теперь пишутся в гренландском языке. Гавайский язык использует кахако (макроны) над гласными, хотя существуют разногласия относительно того, считать ли их отдельными буквами. Кахако над гласной может полностью изменить значение слова, которое пишется одинаково, но без кахако. Курдский язык использует символы Ç, Ê, Î, Ş и Û вместе с 26 стандартными символами латинского алфавита. В алфавите лакота используется гачек для букв č, ȟ, ǧ, š и ž. Также используется акут для обозначения ударных гласных á, é, í, ó, ú, áŋ, íŋ, úŋ. Малайский язык использует некоторые диакритические знаки, такие как á, ā, ç, í, ñ, ó, š, ú. Использование диакритических знаков продолжалось до конца 19 века, за исключением ā и ē. Мальтийский язык использует буквы C, G и Z с точкой над ними (Ċ, Ġ, Ż), а также букву H с дополнительной горизонтальной чертой. Для заглавной H дополнительная черта пишется немного выше обычной черты. Для строчной H дополнительная черта пишется, пересекая вертикальную линию, как буква t, и не касаясь нижней части (Ħ, ħ). Указанные символы считаются отдельными буквами. Буква "c" без точки вышла из употребления из-за избыточности. "Ċ" произносится как английское "ch", а "k" используется для обозначения твердого звука "c", как в слове "cat". "Ż" произносится так же, как английское "Z" в слове "Zebra", в то время как "Z" используется для обозначения звука "ts" в английском языке (как в словах "tsunami" или "maths"). "Ġ" используется для обозначения мягкого звука "G", как в слове "geometry", в то время как "G" произносится как твердый звук "G", как в слове "log". Диграф 'għ' (называемый għajn по названию арабской буквы ʻayn для غ) считается отдельным и иногда располагается после 'g', а в других изданиях – между 'n' и 'o' (латинская буква 'o' изначально произошла от формы финикийской буквы ʻayin, которая традиционно располагалась после финикийской буквы nūn). В романизации сирийского языка используются измененные буквы Ā, Č, Ḏ, Ē, Ë, Ġ, Ḥ, Ō, Š, Ṣ, Ṭ, Ū, Ž наряду с 26 стандартными символами латинского алфавита. Вьетнамский язык использует рогачий диакритический знак для букв ơ и ư; циркумфлекс для букв â, ê и ô; бревис для буквы ă и черту над буквой đ. Кроме того, он также использует á, à, ả, ã и ạ – пять тонов, используемых для гласных, помимо ровного тона 'a'.
Maltese uses a C, G, and Z with a dot over them (Ċ, Ġ, Ż), and also has an H with an extra horizontal bar. For uppercase H, the extra bar is written slightly above the usual bar. For lowercase H, the extra bar is written crossing the vertical, like a t, and not touching the lower part (Ħ, ħ). The above characters are considered separate letters. The letter 'c' without a dot has fallen out of use due to redundancy. 'Ċ' is pronounced like the English 'ch' and 'k' is used as a hard c as in 'cat'. 'Ż' is pronounced just like the English 'Z' as in 'Zebra', while 'Z' is used to make the sound of 'ts' in English (like 'tsunami' or 'maths'). 'Ġ' is used as a soft 'G' like in 'geometry', while the 'G' sounds like a hard 'G' like in 'log'. The digraph 'għ' (called għajn after the Arabic letter name ʻayn for غ) is considered separate, and sometimes ordered after 'g', whilst in other volumes it is placed between 'n' and 'o' (the Latin letter 'o' originally evolved from the shape of Phoenician ʻayin, which was traditionally collated after Phoenician nūn). The romanization of Syriac uses the altered letters of. Ā, Č, Ḏ, Ē, Ë, Ġ, Ḥ, Ō, Š, Ṣ, Ṭ, Ū, Ž alongside the 26 standard Latin alphabet symbols. Vietnamese uses the horn diacritic for the letters ơ and ư; the circumflex for the letters â, ê, and ô; the breve for the letter ă; and a bar through the letter đ. Separately, it also has á, à, ả, ã and ạ, the five tones used for vowels besides the flat tone 'a'.
Кириллица
Белорусская и узбекская кириллица имеют букву ў. Белорусская, болгарская, русская и украинская имеют букву й. Белорусская и русская имеют букву ё. В русском языке эта буква обычно заменяется на е, хотя произношение при этом отличается. Использование е вместо ё не влияет на произношение. Ё всегда используется в детских книгах и словарях. Минимальная пара – все (vs'e, "все" во мн. ч.) и всё (vs'o, "всё" в ед. ч.). В белорусском языке замена на е является ошибкой; в русском языке допустимо использовать как е, так и ё для обозначения ё, но первое более распространено в повседневной письменности (в отличие от учебной или детской литературы). В украинском кириллическом алфавите есть буквы ґ, й и ї. Украинская латиница содержит гораздо больше букв. В македонском языке есть буквы ќ и ѓ. В болгарском и македонском языках притяжательное местоимение ѝ (ì, "её") пишется с острым ударением (грависом), чтобы отличать его от союза и (i, "и"). Острый акцент над любой гласной в кириллических алфавитах используется в словарях, книгах для детей и учебниках для иностранцев для обозначения ударения в слове, а также для различения омографов с разным лексическим ударением.
Belarusian, Bulgarian, Russian and Ukrainian have the letter й.
Belarusian and Russian have the letter ё. In Russian, this letter is usually replaced by е, although it has a different pronunciation. The use of е instead of ё does not affect the pronunciation. Ё is always used in children's books and in dictionaries. A minimal pair is все (vs'e, "everybody" pl.) and всё (vs'o, "everything" n. sg.). In Belarusian the replacement by е is a mistake; in Russian, it is permissible to use either е or ё for ё but the former is more common in everyday writing (as opposed to instructional or juvenile writing). The Cyrillic Ukrainian alphabet has the letters ґ, й and ї. Ukrainian Latynka has many more. Macedonian has the letters ќ and ѓ. In Bulgarian and Macedonian the possessive pronoun ѝ (ì, "her") is spelled with a grave accent in order to distinguish it from the conjunction и (i, "and"). The acute accent above any vowel in Cyrillic alphabets is used in dictionaries, books for children and foreign learners to indicate the word stress, it also can be used for disambiguation of similarly spelled words with different lexical stresses.
Английский
Английский – один из немногих европейских языков, в котором относительно немного слов содержат диакритические знаки. Вместо этого, диграфы являются основным способом, которым современный английский алфавит адаптирует латинский к своим фонемам. Исключения составляют неассимилированные иностранные заимствования, включая слова из французского (и всё чаще из испанского, например, jalapeño и piñata); однако диакритические знаки в таких словах также иногда опускаются. К словам, которые часто встречаются с диакритическими знаками в английском языке, относятся café, résumé или resumé (что помогает отличить их от глагола resume), soufflé и naïveté (см. английские термины с диакритическими знаками). В более старой практике (и даже у некоторых орфографически консервативных современных авторов) можно встретить примеры, такие как élite, mêlée и rôle. Англоязычные авторы и носители языка раньше чаще использовали диаэрезис в словах, таких как coöperation (от фр. coopération), zoölogy (от греч. zoologia) и seeër (сейчас чаще встречается see er или просто seer), чтобы указать, что соседние гласные принадлежат разным слогам, но эта практика стала гораздо менее распространенной. Журнал The New Yorker – одно из крупных изданий, которое продолжает использовать диаэрезис вместо дефиса для ясности и экономии места. Некоторые английские слова, особенно употребляемые вне контекста или изолированно, можно отличить от других слов с тем же написанием только с помощью диакритического знака или измененной буквы. К ним относятся exposé, lamé, maté, öre, øre, résumé и rosé. В некоторых словах диакритические знаки, отсутствовавшие в оригинале, были добавлены для устранения неоднозначности, например, в maté (от исп. и порт. mate), saké (стандартная романизация японского языка не содержит знаков ударения) и Malé (от дивехи މާލެ), чтобы четко отделить их от английских слов mate, sake и male. Острый и гравис иногда используются в поэзии и текстах песен: острый – для явного указания ударения, когда оно может быть неоднозначным (rébel против rebél) или нестандартным по метрическим причинам (caléndar), а гравис – для обозначения произношения обычно непроизносимого или редуцированного слога (warnèd, parlìament). В некоторых личных именах, таких как Renée и Zoë, часто существуют два варианта написания, и предпочтения человека известны только его близким. Даже если имя человека написано с диакритическим знаком, например, Charlotte Brontë, он может быть опущен в англоязычных статьях и даже в официальных документах, таких как паспорта, из-за небрежности, незнания машинисткой ввода букв с диакритическими знаками или технических причин (например, в Калифорнии имена с диакритическими знаками не допускаются, так как компьютерная система не может обрабатывать такие символы). Они также встречаются в названиях некоторых международных компаний и/или товарных знаках, таких как Nestlé и Citroën.
Транслитерация
Некоторые языки, не использующие латинский алфавит, транслитерируются или романизируются с помощью диакритических знаков. Примеры: арабский язык имеет несколько систем романизации, в зависимости от области применения, региона, целевой аудитории, страны и т. д. Многие из них широко используют диакритические знаки, например, некоторые методы используют подстрочный знак для обозначения глоттализованных согласных (ṣ, ṭ, ḍ, ẓ, ḥ). Макрон часто используется для обозначения долгих гласных. Š часто используется для , ġ для . Китайский язык имеет несколько систем романизации, использующих умлаут, но только над буквой u (ü). В системе ханью пиньинь четыре тона мандаринского китайского обозначаются диакритическими знаками: макроном (первый тон), акутом (второй тон), кароном (третий тон) и грависом (четвертый тон). Пример: ā, á, ǎ, à. Романизированный японский язык (Rōmaji) иногда использует макроны для обозначения долгих гласных. Система романизации Хепберна использует макроны для обозначения долгих гласных, а системы Kunrei shiki и Nihon shiki используют циркумфлекс. Санскрит, а также многие языки, произошедшие от него, такие как хинди и бенгали, используют систему романизации без потерь информации IAST. Она включает в себя несколько букв с диакритическими знаками, такими как макрон (ā, ī, ū), надстрочные и подстрочные точки (ṛ, ḥ, ṃ, ṇ, ṣ, ṭ, ḍ), а также другие (ś, ñ).
Arabic has several romanisations, depending on the type of the application, region, intended audience, country, etc. many of them extensively use diacritics, e. g., some methods use an underdot for rendering emphatic consonants (ṣ, ṭ, ḍ, ẓ, ḥ). The macron is often used to render long vowels. š is often used for , ġ for Chinese has several romanizations that use the umlaut, but only on u (ü). In Hanyu Pinyin, the four tones of Mandarin Chinese are denoted by the macron (first tone), acute (second tone), caron (third tone) and grave (fourth tone) diacritics. Example: ā, á, ǎ, à.
Romanized Japanese (Rōmaji) occasionally uses macrons to mark long vowels. The Hepburn romanization system uses macrons to mark long vowels, and the Kunrei shiki and Nihon shiki systems use a circumflex. Sanskrit, as well as many of its descendants, like Hindi and Bengali, uses a lossless romanization system, IAST. This includes several letters with diacritical markings, such as the macron (ā, ī, ū), over and underdots (ṛ, ḥ, ṃ, ṇ, ṣ, ṭ, ḍ) as well as a few others (ś, ñ).
Неортографический/орнативный
Некоторые пользователи исследовали пределы отображения в веб-браузерах и другом программном обеспечении, "украшая" слова избыточными бессмысленными диакритическими знаками на каждый символ, чтобы создать так называемый текст Zalgo.