Введение

Вариант латинского алфавита

исторический кириллический алфавит, использовавшийся для румынского языка

Румынский алфавит — это вариант латинского алфавита, используемый для записи румынского языка. Он является модификацией классического латинского алфавита и состоит из 31 буквы, пять из которых (Ă, Â, Î, Ș и Ț) были изменены по сравнению с их латинскими прототипами с учетом фонетических требований языка:

Буква Название Aa a Ăă ă Ââ â Bb бэ / би Cc це / чи Dd дэ / ди Ee е Ff эф / фэ / фи Gg гэ / гэ / ги Hh хаș / ха / хи Ii и Îî î Jj же / жи Kk ка / капа Ll эл / ле / ли Mm эм / мэ / ми Nn эн / не / ни Oo о Pp пэ / пи Qq кью Rr эр / ре / ри Ss эс / се / си Șș șе / ши Tt тэ / ти Țț цэ / ци Uu у Vv ве / ви Ww дублу ве / дублу ви Xx икс Yy и грек Zz зе / зет / зэд / зи

Буквы Q (кью), W (дублу в) и Y (и грек или игрек, что означает «греческое и») были официально введены в румынский алфавит в 1982 году, хотя они использовались и ранее. Они встречаются только в иностранных словах и их румынских производных, таких как квазар, ватт и яхта. Буква K, хотя и относительно старая, также редко используется и появляется только в собственных именах и международных неологизмах, таких как килограмм, брокер, карате. Эти четыре буквы все еще воспринимаются как иностранные, что объясняет их использование в стилистических целях в таких словах, как nomenklatură (обычно nomenclatură, что означает «номенклатура», но иногда пишется с k вместо c, если речь идет о членах коммунистического руководства в Советском Союзе и странах Восточного блока, как nomenklatura используется в английском языке). В случаях, когда слово является прямым заимствованием, имеющим диакритические знаки, отсутствующие в вышеуказанном алфавите, официальное написание имеет тенденцию отдавать предпочтение их использованию (Мюнхен, Ангулем и т. д., в отличие от использования Стамбула вместо İstanbul).

Буквы и их произношение

Румынская орфография в основном фонетическая, без непроизносимых букв (но см. i). В таблице ниже приведено соответствие между буквами и звуками. Некоторые буквы имеют несколько возможных произношений, даже если не учитывать аллофоны. Когда гласные , , и переходят в соответствующие им полугласные звуки, это не отражается на письме. Буквы К, Q, W и Y встречаются только в заимствованиях; произношение W и Y, а также сочетания QU зависит от происхождения слова. Буква Фонема Приблизительное произношение A a а в слове "father" Ă ă (a с бреве) а в слове "above" Â â (a с циркумфлексом) близкий центральный нелабиализованный гласный, как, например, в последнем слоге слова "roses" у некоторых носителей английского языка B b б в слове "ball" C c к в слове "scan" ч в слове "chimpanzee" – если c стоит перед буквами e или i (но не î); в этом случае e и i обычно не произносятся в сочетаниях: cea (cia в некоторых заимствованиях), cio, ciu и в окончании ci, если оно не ударено D d д в слове "dancing" E e э в слове "merry", перед a или o – полугласный; если не предшествует согласный, становится ye в слове "yes" – в нескольких старых словах с начальным e: este, el и т.д. F f ф в слове "flag" G g г в слове "goat" ж в слове "general" – если g стоит перед буквами e или i (но не î); в этом случае e и i обычно не произносятся в сочетаниях: gea (gia в некоторых заимствованиях), gio (geo в некоторых заимствованиях), giu и в окончании gi, если оно не ударено H h (х, гх) х в шотландском "loch" или h в английском "ha!" или чаще тонкая смесь этих двух (то есть, не такая гортанная, как в шотландском "loch"). Произношение отсутствует, если h стоит между буквами c или g и e или i (che, chi, ghe, ghi); c и g палатализуются I i и в слове "machine" й в слове "yes" Указывает на палатализацию предшествующего согласного (в конце слова и без ударения, в некоторых сложных словах, таких как oricum, и в сочетаниях chia, chio, chiu, ghia, ghio, ghiu) Î î (i с циркумфлексом) Идентично Â, см. выше, используется в начале и в конце слова по этимологическим причинам, напр. "учить" = "a învăța"; "убивать" = "a omorî" J j с в слове "treasure" K k к в слове "scan" (палатализованный перед e и i) L l л в слове "limp" M m м в слове "mouth" N n н в слове "north" O o о в слове "floor", перед a – полугласный; если не предшествует согласный, становится P p п в слове "spot" Q q к в слове "scan" (qu произносится ку, кю, кх) R r альвеолярный трель или тап S s с в слове "song" Ș ș (s с запятой) * ш в слове "shopping" T t т в слове "stone" Ț ț (t с запятой) * ц в слове "cats" U u у в слове "group" в в слове "cow" Французское u или немецкое ü (близкий передний скруглённый гласный) – в некоторых заимствованиях из французского: ecru, tul V v в в слове "vision" W w в в слове "vision" w в слове "west" у в слове "spoon" X x кс в слове "six" икс в слове "example" Y y й в слове "yes" и в слове "machine" Z z з в слове "zipper"

* См. Запятая ниже (ș и ț) в отличие от кадиль (ş и ţ).

В отличие от

Буквы î и â фонетически и функционально идентичны. Причина использования обоих написаний историческая и связана с латинским происхождением языка. На протяжении нескольких десятилетий, до реформы орфографии 1904 года, для обозначения одного и того же фонемы использовалось до четырех-пяти букв (â, ê, î, û, и иногда ô, см. «Исключенные буквы»), в соответствии с этимологическим принципом. Все они использовались для представления гласного звука, к которому сошлись оригинальные латинские гласные с умлаутами. Реформа 1904 года оставила только две буквы – â и î, выбор между которыми определялся правилами, неоднократно менявшимися в течение XX века. В первой половине века действовало правило использования î в начале и конце слова, а â – во всех остальных позициях. Существовали исключения, предписывавшие использование î внутри слова при образовании сложных слов или с помощью приставок и суффиксов. Например, прилагательное urît «уродливый» писалось с î, поскольку оно образовано от глагола a urî «ненавидеть». В 1953 году, в коммунистическую эпоху, Румынская академия исключила букву â, заменив её повсеместно на î, в том числе в названии страны, которое стало писаться Romînia. Это решение совпало с официальным провозглашением страны Народной Республикой, полное название которой стало Republica Populară Romînă. Незначительная реформа орфографии 1964 года вернула букву â, но только в написании слова român «румынский» и всех его производных, включая название страны. Таким образом, Социалистическая Республика, провозглашенная в 1965 году, ассоциировалась с написанием Republica Socialistă România. Вскоре после падения режима Чаушеску Румынская академия приняла решение о восстановлении буквы â с 1993 года, отменив последствия реформы 1953 года и, по сути, вернувшись к правилам 1904 года (с некоторыми отличиями). Этот шаг публично оправдывался как исправление либо коммунистического посягательства на традиции, либо советского влияния на румынскую культуру, и как возвращение к традиционному написанию, отражающему латинское происхождение языка. Однако политический контекст того времени заключался в том, что Румынская академия в значительной степени воспринималась как коммунистическое и коррумпированное учреждение – Николае Чаушеску и его жена Елена были её почетными членами, а членство контролировалось Коммунистической партией. Таким образом, реформа орфографии 1993 года была воспринята как попытка Академии дистанцироваться от своего коммунистического прошлого. Академия пригласила национальное и зарубежных лингвистов, специализирующихся на румынском языке, для обсуждения проблемы; когда большинство из них решительно выступили против реформы, их позиция была однозначно отклонена как излишне научная. Согласно реформе 1993 года, выбор между î и â снова основывается на правиле, которое не является строго этимологическим или фонологическим, а позиционным и морфологическим. Звук всегда пишется как â, за исключением начала и конца слова, где вместо этого используется î. Исключения составляют имена собственные, где написание фиксировано, каким бы оно ни было, и сложные слова, каждый компонент которых подчиняется правилу по отдельности (например, ne + îndemânatic → neîndemânatic «неуклюжий», а не *neândemânatic). Однако, в отличие от нормы 1904 года, это исключение больше не распространяется на слова, образованные с помощью суффиксов; например, слово urît, которое писалось после 1904 года, стало urât после 1993 года. Хотя реформа была представлена как способ подчеркнуть латинское происхождение румынского языка, статистически лишь немногие слова, написанные с â в соответствии с реформой 1993 года, действительно происходят от латинских слов, содержащих a в соответствующей позиции. Фактически, в их число входит большое количество слов, которые содержали i в оригинальном латинском языке и аналогично пишутся с i в их итальянских или испанских аналогах. Примеры включают rîu «река», от латинского rivus (сравните испанский río), теперь написанное râu; наряду с rîde < ridere, sîn < sinus, strînge < stringere, lumînare < luminaria и т. д. Хотя норма орфографии 1993 года является обязательной в румынском образовании и официальных публикациях, и постепенно большинство других изданий перешли на её использование, все еще есть отдельные лица, издания и издательства, предпочитающие предыдущую норму орфографии или собственную смешанную гибридную систему; среди них еженедельный культурный журнал Dilema Veche и ежедневная газета Gazeta Sporturilor. Некоторые издания позволяют авторам выбирать любую норму орфографии; к ним относятся România literară, журнал Союза писателей Румынии, и издательства, такие как Polirom. Словари, грамматики и другие лингвистические работы также продолжают издаваться с использованием î и sînt даже после реформы 1993 года. В конечном счете, конфликт обусловлен двумя различными лингвистическими подходами к тому, как следует писать. Выбор â обусловлен тем, что a является наиболее нейтральным или центральным из пяти гласных (официальная болгарская романизация использует ту же логику, выбирая a для ъ, в результате чего название страны пишется Balgariya; а также европейский португальский гласный для a, упомянутого выше), в то время как î – это попытка выбрать латинскую букву, которая наиболее интуитивно передает звук . (подобно тому, как польский язык использует букву y).

Запятая (ș и ț) против cedilla (ş и ţ)

Хотя румынский академический стандарт предписывает использование вариантов с запятой под буквами для звуков и , варианты с диакритическим знаком "cedilla" всё ещё широко распространены. Многие печатные и онлайн-тексты по-прежнему некорректно используют "s с cedilla" и "t с cedilla". Такое положение дел обусловлено первоначальным отсутствием стандартизации глифов, усугублённым недостаточной поддержкой компьютерных шрифтов для вариантов с запятой под буквами (подробности см. в разделе Unicode). Отсутствие поддержки диакритических знаков в виде запятой под буквами было исправлено в современных версиях основных операционных систем: Windows Vista и более поздних версиях, дистрибутивах Linux после 2005 года и актуальных версиях macOS. По требованию Европейского Союза, Microsoft выпустила обновление шрифтов для устранения этого недостатка в Windows XP (применимо также к Windows 2000/Server 2003) в начале 2007 года, вскоре после вступления Румынии в Европейский Союз.

Другие диакритические знаки

Как и в других языках, в румынских текстах иногда используется острый акцент для обозначения ударной гласной в некоторых словах. Это употребление последовательно встречается в словарных статьях, но также изредка встречается в тщательно отредактированных текстах для различения омографов, которые не являются омофонами, например, для разграничения cópii («копии») и copíi («дети»), éra («эра») и erá («было»), ácele («иглы») и acéle («те»), и так далее. Акцент также различает омографические формы глаголов, такие как încúie и încuié («он запирает» и «он запер»). Диакритические знаки в некоторых заимствованиях сохраняются: bourrée, pietà. Иностранные имена также обычно пишутся с их оригинальными диакритическими знаками: Базель, Мольер, даже если острый акцент может быть ошибочно воспринят как обозначение ударения, как в случае с Иштваном или Жераром. Однако часто используемые иностранные имена, такие как названия городов или стран, часто пишутся без диакритических знаков: Богота, Панама, Перу.

ISO 8859

Стандарт кодирования символов ISO 8859 изначально определял одну страницу кодов для всей Центральной и Восточной Европы — ISO 8859-2. Эта страница кодов включает только символы "s" и "t" с умляутами-остроконечниками (cedilla). Юго-восточноевропейский стандарт ISO 8859-16 включает символы "s" и "t" с запятой под ними на тех же позициях, где в ISO 8859-2 располагались "s" и "t" с умляутами-остроконечниками. Страница кодов ISO 8859-16 стала стандартом уже после широкого распространения Unicode, поэтому производители программного обеспечения в основном её игнорировали.

Adobe/Linotype де-факто стандарт

Adobe Systems решила, что символы Unicode "t с cedilla" U+0162/3 не используются ни в одном языке. (На самом деле они используются, хотя и в очень небольшом количестве языков. "T с Cedilla" входит в состав общего алфавита камерунских языков, встречается в некоторых гагаузских орфографиях, в кабильском диалекте берберского языка и, возможно, в других местах.) В связи с этим Adobe заменила эти символы на "t с запятой под буквой" (U+021A/B) во всех поставляемых ею шрифтах. К сожалению, это привело к тому, что румынские документы, использующие (неофициальные) кодовые точки Unicode U+015E/F и U+0162/3 (для ş и ţ), в шрифтах Adobe отображаются визуально непоследовательно: "s с cedilla" используется для "ş", а "t с запятой" – для "ţ" (см. рисунок). Шрифты Linotype, поддерживающие румынские символы, в основном следуют этой практике. Шрифты, используемые Microsoft до Windows Vista, также реализовывали этот де-факто стандарт Adobe. Лишь немногие шрифты Microsoft обеспечивают единообразный вид при использовании вариантов с cedilla; к ним относятся Tahoma, Verdana, Trebuchet MS, Microsoft Sans Serif и Segoe UI. Бесплатные шрифты DejaVu и Linux Libertine предоставляют корректные и последовательные символы в обоих вариантах. Шрифты Liberation от Red Hat поддерживают только варианты с запятой под буквой, начиная с версии 1.04, запланированной для включения в Fedora 10.

Функция OpenType ROM/locl

Некоторые шрифты OpenType от Adobe и все шрифты Vista серии C реализуют необязательную функцию OpenType GSUB/latn/ROM/locl. Эта функция принудительно отображает символ "s с cedilla" тем же глифом, что и "s с запятой под". Когда происходит это второе (но необязательное) сопоставление, румынский текст в кодировке Unicode отображается глифами с запятой под, независимо от вариантов кодовых точек. К сожалению, большинство шрифтов Microsoft OpenType, выпущенных до Vista (например, Arial), не поддерживают функцию ROM/locl, даже после обновления шрифтов для расширения Европейского Союза.

Информация о поддержке румынского языка в бесплатных шрифтах, поставляемых с Fedora, доступна на сайте Fedoraproject.org.

Комбинация символов

Юникод также позволяет представлять диакритические знаки в виде отдельных комбинируемых диакритических знаков. Соответствующие комбинируемые акценты — U+0326 COMBINING COMMA BELOW и U+0327 COMBINING CEDILLA. Поддержка применения комбинируемого знака «Кома внизу» к буквам S и T в прошлом могла быть реализована некачественно в коммерческих шрифтах, но почти все современные шрифты успешно обрабатывают как знак Cedilla, так и знак «Кома внизу» для S и T. Как и в случае с любыми шрифтами, типографское качество может различаться, поэтому предпочтительнее использовать отдельные кодовые точки. Каждый раз, когда в документе используется комбинируемый диакритический знак, необходимо протестировать используемый шрифт, чтобы убедиться в его корректном отображении.