Введение

Переменная, способная хранить данные разных типов

В информатике объединение (union) – это значение, которое может иметь одно из нескольких представлений или форматов в одном и том же месте в памяти; оно состоит из переменной, способной содержать такую структуру данных. Некоторые языки программирования поддерживают специальные типы данных, называемые типами объединений, для описания таких значений и переменных. Иными словами, определение типа объединения указывает, какой из числа допустимых примитивных типов может быть сохранен в его экземплярах, например, "вещественное число или длинное целое". В отличие от записи (или структуры), которая может быть определена для хранения как вещественного, так и целого числа, в объединении в любой момент времени может храниться только одно значение. Объединение можно представить как участок памяти, используемый для хранения переменных различных типов данных. При присвоении новому полю значения, существующие данные перезаписываются. Область памяти, хранящая значение, не имеет встроенного типа (кроме байтов или слов памяти), но значение может интерпретироваться как один из нескольких абстрактных типов данных, принимая тип значения, которое было записано в эту область памяти последним. В теории типов объединение соответствует суммарному типу; это соответствует дизъюнктному объединению в математике. В зависимости от языка и типа, значение объединения может использоваться в некоторых операциях, таких как присваивание и сравнение на равенство, без знания его конкретного типа. Другие операции могут требовать этой информации, либо посредством внешних данных, либо с использованием помеченного объединения.

Непомеченные союзы

Из-за ограничений их использования, немаркированные объединения обычно предоставляются только в языках с динамической типизацией или небезопасным отношением к типам (как в C). Они имеют преимущество перед простыми маркированными объединениями, поскольку не требуют места для хранения тега типа данных. Название "объединение" происходит от формального определения типа. Если тип рассматривается как множество всех значений, которые он может принимать, то тип объединения представляет собой просто математическое объединение составляющих его типов, поскольку он может принимать любое значение, которое может принимать любое из его полей. Кроме того, поскольку математическое объединение отбрасывает дубликаты, если несколько полей объединения могут принимать одно и то же значение, невозможно определить по значению, какое поле было записано последним. Однако одним из полезных свойств объединений в программировании является возможность сопоставления меньших элементов данных с большими для упрощения манипуляций. Например, структура данных, состоящая из 4 байт и 32-битового целого числа, может образовывать объединение с 64-битовым беззнаковым целым числом, что облегчает доступ к ней для сравнения и других целей.

C/C++

В C и C++ немаркированные объединения выражаются почти так же, как структуры (структы), за исключением того, что каждый член данных начинается в одном и том же месте в памяти. Члены данных, как и в структурах, не обязаны быть примитивными значениями и могут быть структурами или даже другими объединениями. C++ (начиная с C++11) также допускает, чтобы членом данных был любой тип, имеющий полноценный конструктор/деструктор и/или конструктор копирования, или нетривиальный оператор присваивания копированием. Например, можно использовать стандартную строку C++ в качестве члена объединения. Основное назначение объединения – обеспечение доступа к общему участку памяти с использованием различных типов данных, например, для доступа к аппаратному вводу/выводу, обмена битовыми полями и словами или для приведения типов. Объединения также могут обеспечивать низкоуровневый полиморфизм. Однако проверка типов не выполняется, поэтому программист должен убедиться, что в разных контекстах осуществляется доступ к нужным полям. Актуальное поле переменной объединения обычно определяется состоянием других переменных, возможно, в enclosing структуре. Распространенный прием в программировании на C использует объединения для выполнения того, что в C++ называется reinterpret_cast, путем присваивания значения одному полю объединения и чтения из другого, как это делается в коде, зависящем от непосредственного представления значений. Практическим примером является метод вычисления квадратных корней с использованием представления IEEE. Однако это не всегда безопасное использование объединений. Объявления структур и объединений имеют одинаковый формат. [ . ] Размер объединения достаточен для размещения самого большого из его членов. В любой момент времени в объекте объединения может храниться значение только одного из его членов. Указатель на объект объединения, при соответствующем приведении типов, указывает на каждый из его членов (или, если член является битовым полем, то на единицу, в которой оно находится), и наоборот. |ANSI/ISO 9899:1990 (стандарт ANSI C) Раздел 6.5.2.1

Прозрачный союз

В компиляторах, таких как GCC, Clang и IBM XL C для AIX, доступен атрибут для типов объединений. Типы, содержащиеся в объединении, могут быть прозрачно преобразованы к типу самого объединения при вызове функции, при условии, что все типы имеют одинаковый размер. Он предназначен главным образом для функций с множественными параметрами, необходимость использования которых возникла из-за ранних расширений Unix и последующей повторной стандартизации.