Введение

Стандартные кодировки символов на основе ASCII в серии ISO/IEC 8859

ISO/IEC 8859-15:1999, информационные технологии — 8-битные наборы символов с однобайтовым кодированием — Часть 15: Латинский алфавит № 9, является частью серии стандартных кодировок символов ISO/IEC 8859 на основе ASCII, первое издание опубликовано в 1999 году. Он неофициально известен как Latin 9 (и некоторое время как Latin 0). Он похож на ISO 8859-1 и, следовательно, также предназначен для «западноевропейских» языков, но заменяет некоторые редко используемые символы знаком евро и некоторыми буквами, которые считались необходимыми: эта кодировка наиболее часто используется, почти в половине случаев, в немецком языке, хотя это наименее используемая кодировка для немецкого языка. A4A6A8B4B8BCBDBE8859 1¤¦¨´¸¼½¾8859 15€ŠšŽžŒœŸ

ISO 8859-15 является предпочтительным именем набора символов IANA для этого стандарта при его дополнении управляющими кодами C0 и C1 из ISO/IEC 6429. Microsoft присвоила кодовую страницу 28605, также известную как Windows 28605, стандарту ISO 8859-15. IBM присвоила кодовую страницу 923 (CCSID 923) стандарту ISO 8859-15. Все печатаемые символы как из ISO/IEC 8859-1, так и из ISO/IEC 8859-15 также присутствуют в Windows 1252. По состоянию на октябрь 2016 года менее 0,1% (фактически в настоящее время менее 0,02%) всех веб-сайтов используют ISO 8859-15.

История

Идентификатор ISO 8859 15 был предложен для саамских языков в 1996 году, но в конечном итоге был отклонен, хотя и был принят как ISO IR 197. В 1997 году было сделано предложение ISO 8859 0, которое предусматривало замену 4 неиспользуемых или редко используемых символов ISO 8859 1 (, , , и ) на , , , и , что стало необходимым с введением евро. и являются французскими лигатурами, а нужен для того, чтобы французский текст можно было преобразовывать из нижнего регистра в верхний и обратно без потерь. Иронично, но последние три символа уже присутствовали в многонациональном наборе символов DEC (MCS) в 1983 году, от которого произошли ECMA 94 (1985) и ISO 8859 1 (1987). Поскольку их первоначальные кодовые точки были заняты другими символами, для их повторного введения пришлось выбирать менее логичные кодовые точки. В том же предложении также рекомендовалось заменить еще 6 символов (, , , , , ) "другими символами для поддержки максимального количества языков". В итоге и не были заменены. В конечном счете были выбраны четыре символа: , , , и , которые используются в финском и эстонском языках для транслитерации русских заимствований и имен. Предложение было переименовано в ISO 8859 15. Предпринимались попытки сделать ISO 8859 15 набором символов по умолчанию для 8-битной связи, но он так и не смог вытеснить популярный ISO 8859 1. Он некоторое время использовался в качестве набора символов по умолчанию для текстовой консоли и терминальных программ в Linux, когда требовался знак евро, но использование полного Unicode было непрактичным, и впоследствии его заменили на UTF-8.

Покрытие знаков препинания и апострофов

Для некоторых языков, перечисленных выше, отсутствуют корректные типографские кавычки, так как в наборе присутствуют только «, », ", и '. Кроме того, данная кодировка не предоставляет правильный символ для апострофа и направленных одинарных кавычек, хотя в некоторых текстах вместо фигурных кавычек или апострофов используются знак обратного акцента и знак прямого акцента, оба из которых входят в состав ISO 8859-1 (и это надежно работает с некоторыми шрифтами, где все эти символы отображаются в виде наклонных клиновидных символов).

Размещение кода страницы

Отличия от ISO 8859-1 отображаются с кодовой точкой Unicode под символом.