Введение

Целенаправленно неназначенные кодовые точки Unicode – диапазон кодовых точек Unicode PUA. В Unicode, область частного использования (PUA) – это диапазон кодовых точек, которым, по определению, не будут присваиваться символы Консорциумом Unicode. Определены три области частного использования: одна в базовой многоязычной плоскости и по одной в плоскостях 15 и 16, почти полностью охватывающие их. Кодовые точки в этих областях не могут считаться стандартизированными символами самого Unicode. Они намеренно оставлены неопределёнными, чтобы третьи стороны могли определять собственные символы, не конфликтуя с назначениями Консорциума Unicode. В соответствии с политикой стабильности Unicode, области частного использования будут зарезервированы для этой цели во всех будущих версиях Unicode. Назначение символов в области частного использования необязательно должно быть конфиденциальным, то есть строго внутренним для организации; ряд схем назначения был опубликован несколькими организациями. Такая публикация может включать шрифт, поддерживающий определение (отображающий глифы), и программное обеспечение, использующее символы частного использования (например, графический символ для функции «печать документа»). По определению, различные стороны могут присваивать разные символы одной и той же кодовой точке, что может привести к тому, что пользователь увидит один частный символ из установленного шрифта, в то время как предполагался другой.

Определение

Согласно определению Unicode, кодовые точки в частных зонах использования являются назначенными символами, а не несимволами, зарезервированными или неназначенными. Их категория – "Прочее, для частного использования (Co)", и имена символов не определены. Представительные глифы не предоставляются, а семантика символов определяется по взаимной договоренности. Символам для частного использования присваиваются кодовые точки Unicode, интерпретация которых не специфицирована данным стандартом, а использование может быть определено посредством частного соглашения между взаимодействующими пользователями. Эти символы предназначены исключительно для частного использования и не имеют определенной, интерпретируемой семантики, кроме как по взаимной договоренности. Схемы символов для символов частного использования не предоставляются, поскольку любые такие символы по своей сути определяются только вне контекста данного стандарта.

Назначение

В базовой многоязычной плоскости (плоскость 0) блок под названием "Область частного использования" содержит 6400 кодовых точек. Плоскости 15 и 16 почти полностью зарезервированы для двух дополнительных областей частного использования: Дополнительной области частного использования A и Дополнительной области частного использования B соответственно. В UTF-16 подмножество старших суррогатных пар (U+DB80 – U+DBFF) используется исключительно для этих плоскостей и называется старшими суррогатами частного использования.

Персональные символы в других наборах символов

Концепция резервирования конкретных кодовых точек для частного использования основана на аналогичной практике, существовавшей ранее в других наборах символов. В частности, многие устаревшие символы в восточноазиатских письменностях продолжают использоваться в именах или других контекстах, поэтому некоторые наборы символов для этих письменностей предусматривали символы для частного использования (например, пользовательские плоскости CNS 11643 или гайдзи в некоторых японских кодировках). Стандарт Unicode упоминает эти способы использования под названием «Определение символов конечным пользователем» (EUCD). Unicode включает эти символы, но определяет их как управляющие символы (категория Cc), а не символы для частного использования (категория Co). Кодировки, не имеющие областей для частного использования, но содержащие более или менее неиспользуемые области, такие как ISO/IEC 8859 и Shift JIS, породили неконтролируемые варианты этих кодировок. Для Unicode компании могут использовать области для частного использования для добавления необходимых им символов.