Введение

Переменная, представляющая случайное явление

Случайная переменная (также называемая случайной величиной, алеаторной переменной или стохастической переменной) – это математическая формализация величины или объекта, значение которого зависит от случайных событий. Термин «случайная переменная» в математическом определении не подразумевает ни случайность, ни изменчивость, а представляет собой математическую функцию, в которой:

областью определения является множество всех возможных исходов в пространстве элементарных событий (например, множество возможных сторон монеты, выпадающих при броске – орёл или решка); и
областью значений является измеримое пространство (например, соответствующее вышеуказанной области определения, областью значений может быть множество, где орлу сопоставлен 1, а решке – 0). Как правило, область значений случайной переменной является множеством действительных чисел. В неформальном смысле, случайность обычно отражает фундаментальный элемент неопределённости, например, при бросании игральной кости; она также может представлять собой неопределённость, например, погрешность измерения.

Стандартный случай

Во многих случаях, случайная величина принимает действительные значения, то есть является вещественной. В некоторых контекстах термин "случайный элемент" (см. раздел "Расширения") используется для обозначения случайной переменной, не имеющей такой формы. Когда область значений (или диапазон) случайной величины является конечной или бесконечно счетной, случайная переменная называется дискретной, а ее распределение – дискретным распределением вероятностей, то есть может быть описано функцией вероятностной массы, которая присваивает вероятность каждому значению в области значений. Если область значений бесконечно несчетна (обычно это интервал), то случайная величина называется непрерывной. В частном случае, когда она абсолютно непрерывна, ее распределение может быть описано функцией плотности вероятности, которая присваивает вероятности интервалам; в частности, для абсолютно непрерывной случайной величины вероятность каждой отдельной точки обязательно равна нулю. Не все непрерывные случайные величины являются абсолютно непрерывными. Любую случайную величину можно описать ее функцией распределения, которая определяет вероятность того, что случайная величина примет значение, меньшее или равное заданному.

Расширения

Термин "случайная величина" в статистике традиционно ограничивается случаем с вещественными значениями. В этом случае структура вещественных чисел позволяет определить такие величины, как математическое ожидание и дисперсия случайной величины, её функция распределения и моменты распределения. Однако вышеприведённое определение справедливо для любого измеримого пространства значений. Таким образом, можно рассматривать случайные элементы других множеств, таких как случайные булевы значения, категориальные значения, комплексные числа, векторы, матрицы, последовательности, деревья, множества, фигуры, многообразия и функции. Можно конкретно говорить о случайной величине типа или о случайном элементе со значениями в . Эта более общая концепция случайного элемента особенно полезна в таких областях, как теория графов, машинное обучение, обработка естественного языка и другие области дискретной математики и информатики, где часто требуется моделировать случайные изменения нечисловых структур данных. В некоторых случаях, тем не менее, удобно представлять каждый элемент с помощью одного или нескольких вещественных чисел. В этом случае случайный элемент может быть представлен в виде вектора вещественных случайных величин (все определённых на одном и том же базовом вероятностном пространстве , что позволяет различным случайным величинам коварировать). Например: случайное слово может быть представлено случайным целым числом, которое служит индексом в словаре возможных слов. В качестве альтернативы, оно может быть представлено случайным индикаторным вектором, длина которого равна размеру словаря, где единственными значениями с положительной вероятностью являются , , и позиция 1 указывает на слово. Случайное предложение заданной длины может быть представлено вектором из случайных слов. Случайный граф на заданных вершинах может быть представлен матрицей размером из случайных величин, значения которых определяют матрицу смежности случайного графа. Случайная функция может быть представлена набором случайных величин , дающих значения функции в различных точках в области определения функции. Эти являются обычными вещественными случайными величинами, при условии, что функция принимает вещественные значения. Например, стохастический процесс — это случайная функция времени, случайный вектор — это случайная функция по некоторому множеству индексов, такому как , а случайное поле — это случайная функция на любом множестве (обычно времени, пространства или дискретном множестве).

Функции распределения

Если задана случайная величина, определенная на пространстве вероятностей, можно задавать вопросы, например: "Какова вероятность того, что значение равно 2?". Это то же самое, что вероятность события, которое часто записывается как или сокращенно. Запись всех этих вероятностей значений случайной величины дает распределение вероятностей. Распределение вероятностей "забывает" о конкретном пространстве вероятностей, использованном для определения , и фиксирует только вероятности различных значений. Такое распределение вероятностей, если принимает вещественные значения, всегда может быть описано с помощью своей функции распределения, а иногда и с помощью функции плотности вероятности. В терминах теории меры мы используем случайную величину для "отображения" меры на меру на . Мера называется "(распределением) вероятностей" или "законом". Плотность – это производная Радона-Никодима относительно некоторой опорной меры на (часто эта опорная мера является мерой Лебега в случае непрерывных случайных величин или счетной мерой в случае дискретных случайных величин). Базовое пространство вероятностей – это технический инструмент, используемый для гарантии существования случайных величин, иногда для их построения, и для определения понятий, таких как корреляция и зависимость или независимость, основанных на совместном распределении двух или более случайных величин на одном и том же пространстве вероятностей. На практике часто отказываются от пространства и просто определяют меру на , которая присваивает меру 1 всей вещественной прямой, то есть работают с распределениями вероятностей вместо случайных величин. Подробнее см. статью о квантильных функциях.

Дискретная случайная переменная

Рассмотрим эксперимент, в котором человек выбирается случайным образом. Примером случайной величины может служить рост человека. В математическом плане случайная величина интерпретируется как функция, которая отображает человека в его рост. С этой случайной величиной связано распределение вероятностей, позволяющее вычислить вероятность того, что рост попадает в любое подмножество возможных значений, например, вероятность того, что рост находится между 180 и 190 см, или вероятность того, что рост меньше 150 или больше 200 см. Другой случайной величиной может быть число детей у человека; это дискретная случайная величина, принимающая неотрицательные целые значения. Она позволяет вычислять вероятности для отдельных целых значений – функция массы вероятности (PMF) – или для множеств значений, включая бесконечные множества. Например, интересующим событием может быть «четное число детей». Для конечных и бесконечных множеств событий их вероятности можно найти, суммируя значения PMF элементов; то есть вероятность четного числа детей представляется бесконечной суммой. В подобных примерах пространство элементарных событий часто опускается, поскольку его математически сложно описать, и возможные значения случайных величин рассматриваются как пространство элементарных событий. Однако, когда две случайные величины измеряются на одном и том же пространстве элементарных событий, например, рост и число детей у одних и тех же людей, легче отслеживать их взаимосвязь, если признать, что и рост, и число детей принадлежат одному и тому же случайному человеку, чтобы, например, можно было задать вопрос о том, коррелируют ли эти случайные величины. Если и – счетные множества вещественных чисел, и , то является функцией дискретного распределения. Здесь для , для . Например, если взять перечисление всех рациональных чисел как , то получится дискретная функция, которая не обязательно является ступенчатой (кусочно-постоянной).

Непрерывная случайная переменная

Формально, непрерывная случайная переменная – это случайная переменная, функция кумулятивного распределения которой непрерывна во всех точках. Отсутствуют "разрывы", соответствующие числам с ненулевой вероятностью появления. Вместо этого, непрерывные случайные переменные почти никогда не принимают конкретное заданное значение c (формально, ), но существует положительная вероятность того, что их значение попадет в определенный интервал, который может быть сколь угодно малым. Непрерывные случайные переменные обычно описываются функциями плотности вероятности (PDF), которые характеризуют их функцию кумулятивного распределения (CDF) и меры вероятности; такие распределения также называются абсолютно непрерывными. Однако некоторые непрерывные распределения являются сингулярными, или представляют собой смесь абсолютно непрерывной и сингулярной составляющих. Примером непрерывной случайной переменной может служить переменная, основанная на вращающемся указателе, выбирающем горизонтальное направление. Тогда значениями, принимаемыми случайной переменной, будут направления. Мы можем представить эти направления как Север, Запад, Восток, Юг, Юго-Восток и т.д. Однако, как правило, удобнее сопоставить пространство элементарных событий случайной переменной, принимающей значения, являющиеся действительными числами. Это можно сделать, например, путем отображения направления в азимут в градусах по часовой стрелке от Севера. Тогда случайная переменная принимает значения, являющиеся действительными числами из интервала [0, 360), причем все части диапазона равновероятны. В этом случае X = угол вращения. Любое действительное число имеет вероятность быть выбранным, равную нулю, но любому диапазону значений можно присвоить положительную вероятность. Например, вероятность выбора числа в интервале [0, 180] равна 1/2. Вместо понятия функции массы вероятности мы говорим, что плотность вероятности X равна 1/360. Вероятность подмножества [0, 360) можно вычислить, умножив меру множества на 1/360. В общем случае, вероятность множества для заданной непрерывной случайной переменной можно вычислить, проинтегрировав плотность по данному множеству. Более формально, для любого интервала , случайная переменная называется "непрерывной равномерной случайной переменной" (CURV), если вероятность того, что она примет значение в подинтервале, зависит только от длины этого подинтервала. Это означает, что вероятность попадания в любой подинтервал пропорциональна его длине, то есть, если a ≤ c ≤ d ≤ b, то , где последнее равенство является следствием аксиомы нормировки вероятности. Функция плотности вероятности CURV задается индикаторной функцией интервала поддержки, нормализованной на длину интервала: Особый интерес представляет равномерное распределение на единичном интервале . Образцы любого желаемого распределения вероятности можно получить, вычисляя квантильную функцию для случайного числа, равномерно распределенного на единичном интервале. Это использует свойства кумулятивных функций распределения, которые являются универсальной основой для всех случайных переменных.

Смешанный тип

Смешанная случайная переменная — это случайная переменная, функция распределения которой не является ни дискретной, ни всюду непрерывной. Математическое определение с использованием теории меры выглядит следующим образом. Пусть — пространство вероятностей, а — измеримое пространство. Тогда -значная случайная переменная — это измеримая функция , что означает, что для любого подмножества , его прообраз измерим; , где . Это определение позволяет измерять любое подмножество в целевом пространстве, рассматривая его прообраз, который по предположению измерим. В более интуитивных терминах, элемент — это возможный исход, элемент — это измеримое подмножество возможных исходов, функция определяет вероятность каждого такого измеримого подмножества, представляет собой множество значений, которые может принимать случайная переменная (например, множество вещественных чисел), а элемент — это "хорошо определённое" (измеримое) подмножество (то есть подмножество, для которого вероятность может быть определена). Таким образом, случайная переменная — это функция, отображающая каждый исход в некоторое значение, такая что исходы, приводящие к любому полезному подмножеству значений случайной переменной, имеют чётко определённую вероятность. Если — топологическое пространство, то наиболее распространённым выбором для σ-алгебры является σ-алгебра Бореля , которая генерируется коллекцией всех открытых множеств в . В этом случае -значная случайная переменная называется -значной случайной переменной. Кроме того, если пространство — это вещественная прямая , то такая вещественнозначная случайная переменная называется просто случайной переменной.

Реально-значимые случайные переменные

В этом случае пространство наблюдений является множеством действительных чисел. Напомним, Ω – это пространство вероятностей. Для пространства наблюдений, состоящего из действительных чисел, функция x является случайной величиной со значениями в действительных числах, если

Это определение является частным случаем вышесказанного, поскольку множество R генерирует σ-алгебру Бореля на множестве действительных чисел, и достаточно проверить измеримость на любом генерирующем множестве. Здесь мы можем доказать измеримость на этом генерирующем множестве, используя тот факт, что P(x ∈ A) = ∫A dx.

Моменты

Распределение вероятности случайной переменной часто характеризуется небольшим количеством параметров, которые также имеют практическую интерпретацию. Например, часто достаточно знать её "среднее значение". Это отражается в математическом понятии математического ожидания случайной переменной, обозначаемого , и также называемого первым моментом. В общем случае, не равно . Как только "среднее значение" известно, возникает вопрос о том, насколько значения обычно отклоняются от этого среднего значения, на который отвечают дисперсия и стандартное отклонение случайной переменной. можно интуитивно понимать как среднее значение, полученное из бесконечной совокупности, элементами которой являются конкретные реализации . Математически это известно как (обобщённая) проблема моментов: для заданного класса случайных переменных , найти набор функций , таких, что математические ожидания полностью характеризуют распределение случайной переменной.

Моменты могут быть определены только для вещественнозначных функций случайных переменных (или комплекснозначных и т.д.). Если случайная переменная сама по себе вещественнозначна, то можно вычислять моменты самой переменной, которые эквивалентны моментам тождественной функции от этой случайной переменной. Однако даже для не-вещественнозначных случайных переменных можно вычислять моменты вещественнозначных функций этих переменных. Например, для категориальной случайной переменной X, которая может принимать номинальные значения "красный", "синий" или "зеленый", можно построить вещественнозначную функцию ; это использует скобку Айверсона и принимает значение 1, если равна "зеленому", и 0 в противном случае. Затем можно определить математическое ожидание и другие моменты этой функции.

Некоторые свойства

Распределение вероятности суммы двух независимых случайных величин является свёрткой их распределений. Распределения вероятностей не образуют векторное пространство — они не замкнуты относительно линейных комбинаций, поскольку те не сохраняют неотрицательность или интеграл, равный единице, — но они замкнуты относительно выпуклых комбинаций, таким образом образуя выпуклое подмножество пространства функций (или мер).

Эквивалентность случайных переменных

Существует несколько различных способов, в которых случайные величины могут считаться эквивалентными. Две случайные величины могут быть равны, равны почти наверное, или иметь одинаковое распределение. В порядке возрастания строгости точные определения этих понятий эквивалентности приведены ниже.

Сближение

Значимая тема в математической статистике — получение результатов сходимости для определенных последовательностей случайных величин; например, закон больших чисел и центральная предельная теорема. Существуют различные типы сходимости последовательности случайных величин к случайной величине. Они описаны в статье о сходимости случайных величин.