Введение
Целенаправленно неназначенные кодовые точки Unicode – диапазон кодовых точек Unicode PUA. В Unicode, область частного использования (PUA) – это диапазон кодовых точек, которым, по определению, не будут присваиваться символы Консорциумом Unicode. Определены три области частного использования: одна в базовой многоязычной плоскости и по одной в плоскостях 15 и 16, почти полностью охватывающие их. Кодовые точки в этих областях не могут считаться стандартизированными символами самого Unicode. Они намеренно оставлены неопределёнными, чтобы третьи стороны могли определять собственные символы, не конфликтуя с назначениями Консорциума Unicode. В соответствии с политикой стабильности Unicode, области частного использования будут зарезервированы для этой цели во всех будущих версиях Unicode. Назначение символов в области частного использования необязательно должно быть конфиденциальным, то есть строго внутренним для организации; ряд схем назначения был опубликован несколькими организациями. Такая публикация может включать шрифт, поддерживающий определение (отображающий глифы), и программное обеспечение, использующее символы частного использования (например, графический символ для функции «печать документа»). По определению, различные стороны могут присваивать разные символы одной и той же кодовой точке, что может привести к тому, что пользователь увидит один частный символ из установленного шрифта, в то время как предполагался другой.
the Unicode PUA range of codepoints
In Unicode, a Private Use Area (PUA) is a range of code points that, by definition, will not be assigned characters by the Unicode Consortium. Three private use areas are defined: one in the Basic Multilingual Plane , and one each in, and nearly covering, planes 15 and 16 (, ). The code points in these areas cannot be considered as standardized characters in Unicode itself. They are intentionally left undefined so that third parties may define their own characters without conflicting with Unicode Consortium assignments. Under the Unicode Stability Policy, the Private Use Areas will remain allocated for that purpose in all future Unicode versions. Assignments to Private Use Area characters need not be private in the sense of strictly internal to an organisation; a number of assignment schemes have been published by several organisations. Such publication may include a font that supports the definition (showing the glyphs), and software making use of the private use characters (e. g. a graphics character for a "print document" function). By definition, multiple private parties may assign different characters to the same code point, with the consequence that a user may see one private character from an installed font where a different one was intended.
Определение
Согласно определению Unicode, кодовые точки в частных зонах использования являются назначенными символами, а не несимволами, зарезервированными или неназначенными. Их категория – "Прочее, для частного использования (Co)", и имена символов не определены. Представительные глифы не предоставляются, а семантика символов определяется по взаимной договоренности. Символам для частного использования присваиваются кодовые точки Unicode, интерпретация которых не специфицирована данным стандартом, а использование может быть определено посредством частного соглашения между взаимодействующими пользователями. Эти символы предназначены исключительно для частного использования и не имеют определенной, интерпретируемой семантики, кроме как по взаимной договоренности. Схемы символов для символов частного использования не предоставляются, поскольку любые такие символы по своей сути определяются только вне контекста данного стандарта.
Назначение
В базовой многоязычной плоскости (плоскость 0) блок под названием "Область частного использования" содержит 6400 кодовых точек. Плоскости 15 и 16 почти полностью зарезервированы для двух дополнительных областей частного использования: Дополнительной области частного использования A и Дополнительной области частного использования B соответственно. В UTF-16 подмножество старших суррогатных пар (U+DB80 – U+DBFF) используется исключительно для этих плоскостей и называется старшими суррогатами частного использования.
Персональные символы в других наборах символов
Концепция резервирования конкретных кодовых точек для частного использования основана на аналогичной практике, существовавшей ранее в других наборах символов. В частности, многие устаревшие символы в восточноазиатских письменностях продолжают использоваться в именах или других контекстах, поэтому некоторые наборы символов для этих письменностей предусматривали символы для частного использования (например, пользовательские плоскости CNS 11643 или гайдзи в некоторых японских кодировках). Стандарт Unicode упоминает эти способы использования под названием «Определение символов конечным пользователем» (EUCD). Unicode включает эти символы, но определяет их как управляющие символы (категория Cc), а не символы для частного использования (категория Co). Кодировки, не имеющие областей для частного использования, но содержащие более или менее неиспользуемые области, такие как ISO/IEC 8859 и Shift JIS, породили неконтролируемые варианты этих кодировок. Для Unicode компании могут использовать области для частного использования для добавления необходимых им символов.