Сравнивайте с английским: нажмите на абзац — оригинал откроется в окне. Кнопка EN под абзацем показывает его прямо в тексте.
Введение
Латинские буквы с точкой İ i и без точки I ı, которые являются разными буквами в алфавитах ряда тюркских языков, в отличие от английского и большинства языков, использующих латинский шрифт, создавали определенные проблемы в информатике.
The Latin derived letters dotted İ i and dotless I ı, which are distinct letters in the alphabets of a number of Turkic languages, unlike in English and most languages using the Latin script, have caused some issues in computing.
Трудности
Юникод не кодирует заглавную форму безточечной I и строчную форму точечной İ отдельно от их базовых букв, а вместо этого объединяет их с заглавными и строчными формами латинской буквы I соответственно. Джон Коуэн предложил разделить обычную Ii на заглавную безточечную I и строчную I с точкой над ней, чтобы сделать регистр более последовательным. Технический комитет Unicode ранее отклонил аналогичное предложение, поскольку это нарушило бы соответствие между символами в кодировках с точечной и безточечной I и повредило бы данные в этих языках. Большинство программного обеспечения Unicode преобразует ı в I при переходе в верхний регистр, но, если не настроено специально для турецкого языка, преобразует I в i при переходе в нижний регистр. Таким образом, последовательное преобразование в верхний и затем в нижний регистр изменяет буквы. Аналогично, большинство программного обеспечения Unicode преобразует i в I при переходе в верхний регистр, изменяя букву в процессе. В SDK Microsoft Windows, начиная с Windows Vista, несколько соответствующих функций имеют флаг NORM_LINGUISTIC_CASING, указывающий, что для турецкой и азербайджанской локалей I должно соответствовать ı. В языке верстки LaTeX безточечную ı можно записать с помощью команды \i. Точечная İ и безточечная ı представляют проблему в турецких локалях нескольких программных пакетов, включая Oracle DBMS, PHP, Java (программная платформа) и Unixware 7, где неявное изменение регистра имен ключевых слов, переменных и таблиц приводит к последствиям, не предусмотренным разработчиками приложений. Локали C или американский английский не имеют этих проблем. .NET Framework имеет специальные механизмы для обработки «турецкой i». Многие мобильные телефоны, доступные в Турции (по состоянию на 2008 год), не имели корректной локализации, что приводило к замене ı на i в SMS, иногда сильно искажая смысл текста. В одном случае, ошибка в коммуникации сыграла роль в гибели Эмине и Рамазана Чалчобан в 2008 году. Распространенной заменой является использование символа 1 вместо безточечной ı. Это также распространено в Азербайджане (см. также транслитерацию), но значение слов обычно понимается. В некоторых переводчиках Ectaco буква İ также рассматривалась как I (например, TRAFIK вместо TRAFİK).
Unicode does not encode the uppercase form of dotless I and lowercase form of dotted İ separately from their base letters, and instead merges them with the upper and lower case forms of the Latin letter I respectively. John Cowan proposed disunification of plain Ii as capital letter dotless I and small letter I with dot above to make the casing more consistent. The Unicode Technical Committee had previously rejected a similar proposal because it would corrupt mapping from character sets with dotted and dotless I and corrupt data in these languages. Most Unicode software uppercases ı to I, but, unless specifically configured for Turkish, it lowercases I to i. Thus uppercasing then lowercasing changes the letters. Likewise, most Unicode software uppercases i to I, changing the letter in the process. In the Microsoft Windows SDK, beginning with Windows Vista, several relevant functions have a NORM LINGUISTIC CASING flag, to indicate that for Turkish and Azerbaijani locales, I should map to ı. In the LaTeX typesetting language the dotless ı can be written with the backslash i command: \i. Dotted İ and dotless ı are problematic in the Turkish locales of several software packages, including Oracle DBMS, PHP, Java (software platform), and Unixware 7, where implicit capitalization of names of keywords, variables, and tables has effects not foreseen by the application developers. The C or US English locales do not have these problems. The NET Framework has special provisions to handle the 'Turkish i'''. Many cellphones available in Turkey (as of 2008) lacked a proper localization, which led to replacing ı by i in SMS, sometimes severely distorting the sense of a text. In one instance, a miscommunication played a role in the deaths of Emine and Ramazan Çalçoban in 2008. A common substitution is to use the character 1 for dotless ı. This is also common in Azerbaijan (see also translit), but the meaning of words is generally understood. In some Ectaco translators, the letter İ was also treated as I (e. g. TRAFIK , when it is normally TRAFİK'').