Глава 7.

Конкретные законы распределения случайных величин

Виды законов распределения дискретных случайных величин

Пусть дискретная случайная величина может принимать значения х 1 , х 2 , …, х n , … . Вероятности этих значений могут быть вычислены по различным формулам, например, при помощи основных теорем теории вероятностей, формулы Бернулли или по каким-то другим формулам. Для некоторых из этих формул закон распределения имеет свое название.

Наиболее часто встречающимися законами распределения дискретной случайной величины являются биномиальный, геометрический, гипергеометрический, закон распределения Пуассона.

Биномиальный закон распределения

Пусть производится n независимых испытаний, в каждом из которых может появиться или не появиться событие А . Вероятность появления этого события в каждом единичном испытании постоянна, не зависит от номера испытания и равна р =Р (А ). Отсюда вероятность не появления события А в каждом испытании также постоянна и равна q =1–р . Рассмотрим случайную величину Х равную числу появлений события А в n испытаниях. Очевидно, что значения этой величины равны

х 1 =0 – событие А в n испытаниях не появилось;

х 2 =1 – событие А в n испытаниях появилось один раз;

х 3 =2 – событие А в n испытаниях появилось два раза;

…………………………………………………………..

х n +1 = n – событие А в n испытаниях появилось все n раз.

Вероятности этих значений могут быть вычислены по формуле Бернулли (4.1):

где к =0, 1, 2, …, n .

Биномиальным законом распределения Х , равной числу успехов в n испытаниях Бернулли, с вероятностью успеха р .

Итак, дискретная случайная величина имеет биномиальное распределение (или распределена по биномиальному закону), если ее возможные значения 0, 1, 2, …, n , а соответствующие вероятности вычисляются по формуле (7.1).

Биномиальное распределение зависит от двух параметров р и n .

Ряд распределения случайной величины, распределенной по биномиальному закону, имеет вид:

Биноминальное распределение. Биномиальное распределение

Теория вероятности незримо присутствует в нашей жизни. Мы не обращаем на это внимания, но каждое событие в нашей жизни имеет ту или иную вероятность. Принимая во внимание огромное количество вариантов развития событий, нам становится необходимым определять наиболее вероятные и наименее вероятные из них. Наиболее удобно анализировать такие вероятностные данные графически. В этом нам может помочь распределение. Биномиальное - одно из самых лёгких и самых точных.

Прежде чем перейти непосредственно к математике и теории вероятности, разберёмся с тем, кто же первый придумал такой вид распределения и какова история развития математического аппарата для этого понятия.

История

Понятие вероятности известно ещё с древних времён. Однако древние математики не придавали ей особо значения и смогли заложить только основы для теории, ставшей впоследствии теорией вероятности. Они создали некоторые комбинаторные методы, которые сильно помогли тем, кто позже создал и развил саму теорию.

Во второй половине семнадцатого века началось формирование основных понятий и методов теории вероятности. Были введены определения случайных величин, способы вычисления вероятности простых и некоторых сложных независимых и зависимых событий. Продиктован такой интерес к случайным величинам и вероятностям был азартными играми: каждый человек хотел знать, какие у него шансы победить в игре.

Следующим этапом стало применение в теории вероятности методов математического анализа. Этим занялись видные математики, такие как Лаплас, Гаусс, Пуассон и Бернулли. Именно они продвинули эту область математики на новый уровень. Именно Джеймс Бернулли открыл биномиальный закон распределения. Кстати, как мы позже выясним, на основе этого открытия были сделаны ещё несколько, которые позволили создать закон нормального распределения и ещё множество других.

Сейчас, прежде чем начать описывать распределение биномиальное, мы немного освежим в памяти понятия теории вероятностей, наверняка уже забытые со школьной скамьи.

Основы теории вероятностей

Будем рассматривать такие системы, в результате действия которых возможны только два исхода: "успех" и "не успех". Это легко понять на примере: мы подбрасываем монетку, загадав то, что выпадет решка. Вероятности каждого из возможных событий (выпадет решка - "успех", выпадет орёл - "не успех") равны 50 процентам при идеальной балансировке монеты и отсутствии прочих факторов, которые могут повлиять на эксперимент.

Это было самое простое событие. Но бывают ещё и сложные системы, в которых выполняются последовательные действия, и вероятности исходов этих действий будут различаться. Например, рассмотрим такую систему: в коробке, содержимое которой мы не можем разглядеть, лежат шесть абсолютно одинаковых шариков, три пары синего, красного и белого цветов. Мы должны достать наугад несколько шариков. Соответственно, вытащив первым один из белых шариков, мы уменьшим в разы вероятность того, что следующим нам тоже попадётся белый шарик. Происходит это потому, что меняется количество объектов в системе.

В следующем разделе рассмотрим более сложные математические понятия, вплотную подводящие нас к тому, что означают слова "нормальное распределение", "биномиальное распределение" и тому подобные.

Элементы математической статистики

В статистике, которая является одной из областей применения теории вероятностей, существует множество примеров, когда данные для анализа даны не в явном виде. То есть не в численном, а в виде разделения по признакам, например, по половым. Для того чтобы применить к таким данным математический аппарат и сделать из полученных результатов какие-то выводы, требуется перевести исходные данные в числовой формат. Как правило, для осуществления этого положительному исходу присваивают значение 1, а отрицательному - 0. Таким образом, мы получаем статистические данные, которые можно подвергнуть анализу с помощью математических методов.

Следующий шаг в понимании того, что такое биномиальное распределение случайной величины, - это определение дисперсии случайной величины и математического ожидания. Об этом поговорим в следующем разделе.

Математическое ожидание

На самом деле понять то, что такое математическое ожидание, несложно. Рассмотрим систему, в которой существует много разных событий со своими различными вероятностями. Математическим ожиданием будет называться величина, равная сумме произведений значений этих событий (а математическом виде, о котором мы говорили в прошлом разделе) на вероятности их осуществления.

Математическое ожидание биномиального распределения рассчитывается по той же самой схеме: мы берём значение случайной величины, умножаем его на вероятность положительного исхода, а затем суммируем полученные данные для всех величин. Очень удобно представить эти данные графически - так лучше воспринимается разница между математическими ожиданиями разных величин.

В следующем разделе мы расскажем вам немного о другом понятии - дисперсии случайной величины. Оно тоже тесно связано с таким понятием, как биномиальное распределение вероятностей, и является его характеристикой.

Дисперсия биномиального распределения

Эта величина тесно связана с предыдущей и также характеризует распределение статистических данных. Она представляет собой средний квадрат отклонений значений от их математического ожидания. То есть дисперсия случайной величины - это сумма квадратов разностей между значением случайной величины и её математическим ожиданием, умноженная на вероятность этого события.

В общем, это всё, что нам нужно знать о дисперсии для понимания того, что такое биномиальное распределение вероятностей. Теперь перейдём непосредственно к нашей основной теме. А именно к тому, что же кроется за таким на вид достаточно сложным словосочетанием "биномиальный закон распределения".

Биномиальное распределение

Разберёмся для начала, почему же это распределение биномиальное. Оно происходит от слова "бином". Может быть, вы слышали о биноме Ньютона - такой формуле, с помощью которой можно разложить сумму двух любых чисел a и b в любой неотрицательной степени n.

Как вы, наверное, уже догадались, формула бинома Ньютона и формула биномиального распределения - это практически одинаковые формулы. За тем лишь исключением, что вторая имеет прикладное значение для конкретных величин, а первая - лишь общий математический инструмент, применения которого на практике могут быть различны.

Формулы распределения

Функция биномиального распределения может быть записана в виде суммы следующих членов:

(n!/(n-k)!k!)*p k *q n-k

Здесь n - число независимых случайных экспериментов, p- число удачных исходов, q- число неудачных исходов, k - номер эксперимента (может принимать значения от 0 до n),! - обозначение факториала, такой функции числа, значение которой равно произведению всех идущих до неё чисел (например, для числа 4: 4!=1*2*3*4=24).

Помимо этого, функция биномиального распределения может быть записана в виде неполной бета-функции. Однако это уже более сложное определение, которое используется только при решении сложных статистических задач.

Биномиальное распределение, примеры которого мы рассмотрели выше, - одно из самых простых видов распределений в теории вероятностей. Существует также нормальное распределение, являющееся одним из видов биномиального. Оно используется чаще всего, и наиболее просто в расчётах. Бывает также распределение Бернулли, распределение Пуассона, условное распределение. Все они характеризуют графически области вероятности того или иного процесса при разных условиях.

В следующем разделе рассмотрим аспекты, касающиеся применения этого математического аппарата в реальной жизни. На первый взгляд, конечно, кажется, что это очередная математическая штука, которая, как обычно, не находит применения в реальной жизни, и вообще не нужна никому, кроме самих математиков. Однако это далеко не так. Ведь все виды распределений и их графические представления были созданы исключительно под практические цели, а не в качестве прихоти учёных.

Применение

Безусловно, самое важное применение распределения находят в статистике, ведь там нужен комплексный анализ множества данных. Как показывает практика, очень многие массивы данных имеют примерно одинаковые распределения величин: критические области очень низких и очень высоких величин, как правило, содержат меньше элементов, чем средние значения.

Анализ больших массивов данных требуется не только в статистике. Он незаменим, например, в физической химии. В этой науке он используется для определения многих величин, которые связаны со случайными колебаниями и перемещениями атомов и молекул.

В следующем разделе разберёмся, насколько важно применение таких статистических понятий, как биномиальное распределение случайной величины в повседневной жизни для нас с вами.

Зачем мне это нужно?

Многие задают себе такой вопрос, когда дело касается математики. А между прочим, математика не зря называется царицей наук. Она является основой физики, химии, биологии, экономики, и в каждой из этих наук применяется в том числе и какое-либо распределение: будь это дискретное биномиальное распределение, или же нормальное, не важно. И если мы получше присмотримся к окружающему миру, то увидим, что математика применяется везде: в повседневной жизни, на работе, да даже человеческие отношения можно представить в виде статистических данных и провести их анализ (так, кстати, и делают те, кто работают в специальных организациях, занимающихся сбором информации).

Сейчас поговорим немного о том, что же делать, если вам нужно знать по данной теме намного больше, чем то, что мы изложили в этой статье.

Та информация, что мы дали в этой статье, далеко не полная. Существует множество нюансов, касаемо того, какую форму может принимать распределение. Биномиальное распределение, как мы уже выяснили, является одним из основных видов, на котором зиждется вся математическая статистика и теория вероятностей.

Если вам стало интересно, или в связи с вашей работой вам нужно знать по этой теме гораздо больше, нужно будет изучить специализированную литературу. Начать следует с университетского курса математического анализа и дойти там до раздела теории вероятностей. Также пригодятся знания в области рядов, ведь биномиальное распределение вероятностей - это ни что иное, как ряд последовательных членов.

Заключение

Прежде чем закончить статью, мы хотели бы рассказать ещё одну интересную вещь. Она касается непосредственно темы нашей статьи и всей математики в целом.

Многие люди твердят, что математика - бесполезная наука, и ничто из того, что они проходили в школе, им не пригодилось. Но знание ведь никогда не бывает лишним, и если вам что-то не пригодилось в жизни, значит, вы просто этого не помните. Если у вас есть знания, они могут вам помочь, но если их нет, то и помощи от них ждать не приходится.

Итак, мы рассмотрели понятие биномиального распределения и все связанные с ним определения и поговорили о том, как же это применяется в нашей с вами жизни.

Распределения вероятностей дискретных случайных величин. Биномиальное распределение. Распределение Пуассона. Геометрическое распределение. Производящая функция.

6. Распределения вероятностей дискретных случайных величин

6.1. Биномиальное распределение

Пусть производится n независимых испытаний, в каждом из которых событие A может либо появится, либо не появится. Вероятность p появления события A во всех испытаниях постоянна и не изменяется от испытания к испытанию. Рассмотрим в качестве случайной величины X число появлений события A в этих испытаниях. Формула, позволяющая найти вероятность появления события A ровно k раз в n испытаниях, как известно, описывается формулой Бернулли

Распределение вероятностей, определяемое формулой Бернулли, называется биномиальным .

Этот закон назван "биномиальным" потому, что правую часть можно рассматривать как общий член разложения бинома Ньютона

Запишем биномиальный закон в виде таблицы


	p n	np n –1 q				q n

Найдем числовые характеристики этого распределения.

По определению математического ожидания для ДСВ имеем

Запишем равенство, являющееся бином Ньютона

и продифференцируем его по p. В результате получим

Умножим левую и правую часть на p :

Учитывая, что p + q =1, имеем

(6.2)

Итак, математическое ожидание числа появлений событий в n независимых испытаниях равно произведению числа испытаний n на вероятность p появления события в каждом испытании .

Дисперсию вычислим по формуле

Для этого найдем

Предварительно продифференцируем формулу бинома Ньютона два раза по p :

и умножим обе части равенства на p 2:

Следовательно,

Итак, дисперсия биномиального распределения равна

. (6.3)

Данные результаты можно получить и из чисто качественных рассуждений. Общее число X появлений события A во всех испытаниях складываются из числа появлений события в отдельных испытаниях. Поэтому если X 1 – число появлений события в первом испытании, X 2 – во втором и т.д., то общее число появлений события A во всех испытаниях равно X=X 1 +X 2 +…+X n . По свойству математического ожидания:

Каждое из слагаемых правой части равенства есть математическое ожидание числа событий в одном испытании, которое равно вероятности события. Таким образом,

По свойству дисперсии:

Так как , а математическое ожидание случайной величины, которое может принимать только два значения, а именно 1 2 с вероятностью p и 0 2 с вероятностью q , то
. Таким образом,
В результате, получаем

Воспользовавшись понятием начальных и центральных моментов, можно получить формулы для асимметрии и эксцесса:

. (6.4)

Рис. 6.1

Многоугольник биномиального распределения имеет следующий вид (см. рис. 6.1). ВероятностьP n (k ) сначала возрастает при увеличении k , достигает наибольшего значения и далее начинает убывать. Биномиальное распределение асимметрично, за исключением случая p =0,5. Отметим, что при большом числе испытаний n биномиальное распределение весьма близко к нормальному. (Обоснование этого предложения связано с локальной теоремой Муавра-Лапласа.)

Число m 0 наступлений события называется наивероятнейшим , если вероятность наступления события данное число раз в этой серии испытаний наибольшая (максимум в многоугольнике распределения) . Для биномиального распределения

Замечание. Данное неравенство можно доказать, используя рекуррентную формулу для биномиальных вероятностей:

(6.6)

Пример 6.1. Доля изделий высшего сорта на данном предприятии составляет 31%. Чему равно математического ожидание и дисперсия, также наивероятнейшее число изделий высшего сорта в случайно отобранной партии из 75 изделий?

Решение. Поскольку p =0,31, q =0,69, n =75, то

M[X ] = np = 750,31 = 23,25; D[X ] = npq = 750,310,69 = 16,04.

Для нахождения наивероятнейшего числа m 0 , составим двойное неравенство

Отсюда следует, что m 0 = 23.

В отличие от нормального и равномерного распределений, описывающих поведение переменной в исследуемой выборке испытуемых, биномиальное распределение используется для иных целей. Оно служит для прогнозирования вероятности двух взаимоисключающих событий в некотором числе независимых друг от друга испытаний. Классический пример биномиального распределения – подбрасывание монеты, которая падает на твердую поверхность. Равновероятны два исхода (события): 1) монета падает «орлом» (вероятность равна р ) или 2) монета падает «решкой» (вероятность равна q ). Если третьего исхода не дано, то p = q = 0,5 и p + q = 1. Используя формулу биномиального распределения, можно определить, например, какова вероятность того, что в 50 испытаниях (число подбрасываний монеты) последняя выпадет «орлом», предположим, 25 раз.

Для дальнейших рассуждений введем общепринятые обозначения:

n – общее число наблюдений;

i – число интересующих нас событий (исходов);

n – i – число альтернативных событий;

p – эмпирически определенная (иногда – предполагаемая) вероятность интересующего нас события;

q – вероятность альтернативного события;

P n (i ) – прогнозируемая вероятность интересующего нас события i по определенному числу наблюдений n .

Формула биномиального распределения:

В случае равновероятного исхода событий (p = q ) можно использовать упрощенную формулу:

(6.8)

Рассмотрим три примера, иллюстрирующие использование формул биномиального распределения в психологических исследованиях.

Пример 1

Предположим, что 3 студента решают задачу повышенной сложности. Для каждого из них равновероятны 2 исхода: (+) – решение и (-) – нерешение задачи. Всего возможно 8 разных исходов (2 3 = 8).

Вероятность того, что ни один студент не справится с задачей, равна 1/8 (вариант 8); 1 студент справится с задачей: P = 3/8 (варианты 4, 6, 7); 2 студента – P = 3/8 (варианты 2, 3, 5) и 3 студента – P =1/8 (вариант 1).

Необходимо определить вероятность того, что трое из 5 студентов успешно справятся с данной задачей.

Решение

Всего возможных исходов: 2 5 = 32.

Общее число вариантов 3(+) и 2(-) составляет

Следовательно, вероятность ожидаемого исхода равна 10/32 » 0,31.

Пример 3

Задание

Определить вероятность того, что в группе из 10 случайных испытуемых обнаружится 5 экстравертов.

Решение

1. Вводим обозначения: p = q = 0,5; n = 10; i = 5; P 10 (5) = ?

2. Используем упрощенную формулу (см. выше):

Вывод

Вероятность того, что среди 10 случайных испытуемых обнаружится 5 экстравертов, составляет 0,246.

Примечания

1. Вычисление по формуле при достаточно большом числе испытаний достаточно трудоемко, поэтому в этих случаях рекомендуется использовать таблицы биномиального распределения.

2. В некоторых случаях значения p и q можно задать изначально, но не всегда. Как правило, они вычисляются по результатам предварительных испытаний (пилотажных исследований).

3. В графическом изображении (в координатах P n (i ) = f (i )) биномиальное распределение может иметь различный вид: в случае p = q распределение симметрично и напоминает нормальное распределение Гаусса; асимметрия распределения тем больше, чем больше разница между вероятностями p и q .

Распределение Пуассона

Распределение Пуассона является частным случаем биномиального распределения, используемым при очень низкой вероятности интересующих нас событий. Другими словами, это распределение описывает вероятность редких событий. Формулой Пуассона можно пользоваться при p < 0,01 и q ≥ 0,99.

Уравнение Пуассона является приближенным и описывается следующей формулой:

(6.9)

где μ представляет собой произведение средней вероятности события и числа наблюдений.

В качестве примера рассмотрим алгоритм решения следующей задачи.

Условие задачи

За несколько лет в 21 крупной клинике России было проведено массовое обследование новорожденных на предмет заболевания младенцев болезнью Дауна (выборка в среднем составляла 1000 новорожденных в каждой клинике). Были получены следующие данные:

Задание

1. Определить среднюю вероятность заболевания (в пересчете на число новорожденных).

2. Определить, на какое число новорожденных в среднем приходится одно заболевание.

3. Определить вероятность того, что среди 100 случайно выбранных новорожденных обнаружится 2 младенца с болезнью Дауна.

Решение

1. Определяем среднюю вероятность заболевания. При этом мы должны руководствоваться следующими рассуждениями. Болезнь Дауна зарегистрирована лишь в 10 клиниках из 21. В 11 клиниках заболеваний не обнаружено, в 6 клиниках зарегистрировано по 1 случаю, в 2 клиниках – 2 случая, в 1-й клинике – 3 и в 1-й клинике – 4 случая болезни. 5 случаев заболевания не было обнаружено ни в одной клинике. Для того чтобы определить среднюю вероятность заболевания, необходимо общее число случаев (6·1 + 2·2 + 1·3 + 1·4 = 17) разделить на общее число новорожденных (21000):

2. Число новорожденных, на которое приходится одно заболевание, является величиной обратной средней вероятности, т. е. равно общему числу новорожденных, отнесенному к числу зарегистрированных случаев:

3. Подставляем значения p = 0,00081, n = 100 и i = 2 в формулу Пуассона:

Ответ

Вероятность того, что среди 100 случайно выбранных новорожденных обнаружится 2 младенца с болезнью Дауна, составляет 0,003 (0,3%).

Задачи по теме

Задача 6. 1

Задание

Пользуясь данными задачи 5.1 по времени сенсомоторной реакции, вычислить асимметрию и эксцесс распределения ВР.

Задача 6. 2

200 учащихся выпускных классов были протестированы на уровень интеллектуальности (IQ ). После нормирования полученного распределения IQ по стандартному отклонению были получены следующие результаты:

Задание

Пользуясь критериями Колмогорова и хи-квадрат, определить, соответствует ли полученное распределение показателей IQ нормальному.

Задача 6. 3

У взрослого испытуемого (мужчина 25 лет) исследовалось время простой сенсомоторной реакции (ВР) в ответ на звуковой стимул с постоянной частотой в 1 кГц и интенсивностью 40 дБ. Стимул предъявлялся стократно с интервалами 3 – 5 секунд. Отдельные значения ВР по 100 повторностям распределилось следующим образом:

Задание

1. Построить частотную гистограмму распределения ВР; определить среднее значение ВР и величину стандартного отклонения.

2. Рассчитать коэффициент асимметрии и показатель эксцесса распределения ВР; на основании полученных значений As и Ex сделать вывод о соответствии или несоответствии данного распределения нормальному.

Задача 6. 4

В 1998 году в Нижнем Тагиле окончили школы с золотыми медалями 14 человек (5 юношей и 9 девушек), с серебряными – 26 человек (8 юношей и 18 девушек).

Вопрос

Можно ли утверждать, что девушки получают медали чаще, чем юноши?

Примечание

Соотношение числа юношей и девушек в генеральной совокупности считать равным.

Задача 6. 5

Считается, что число экстравертов и интровертов в однородной группе испытуемых является приблизительно одинаковым.

Задание

Определить вероятность того, что в группе из 10 случайно отобранных испытуемых обнаружится 0, 1, 2, ..., 10 экстравертов. Построить графическое выражение распределения вероятностей обнаружения 0, 1, 2, ..., 10 экстравертов в данной группе.

Задача 6. 6

Задание

Рассчитать вероятность P n (i) функции биномиального распределения при p = 0,3 и q = 0,7 для значений n = 5 и i = 0, 1, 2, ..., 5. Построить графическое выражение зависимости P n (i) = f (i).

Задача 6. 7

В последние годы среди определенной части населения утвердилась вера в астрологические прогнозы. По результатам предварительных опросов установлено, что в астрологию верят около 15% населения.

Задание

Определить вероятность того, что среди 10 случайно выбранных респондентов окажется 1, 2 или 3 человека, верящих в астрологические прогнозы.

Задача 6. 8

Условие задачи

В 42 общеобразовательных школах г. Екатеринбурга и Свердловской области (общее число учащихся 12260 человек) за несколько лет было выявлено следующее число случаев психических заболеваний среди школьников:

Задание

Пусть будет выборочно обследовано 1000 школьников. Рассчитать, какова вероятность того, что среди этой тысячи школьников будет выявлен 1, 2 или 3 психически больных ребенка?

РАЗДЕЛ 7. МЕРЫ РАЗЛИЧИЙ

Постановка проблемы

Предположим, что мы имеем две независимые друг от друга выборки испытуемых х и у . Независимыми выборки считаются тогда, когда один и тот же субъект (испытуемый) фигурирует только в одной выборке. Задача состоит в том, чтобы сравнить между собой эти выборки (два ряда переменных) на предмет их различий. Естественно, что как бы ни были близки между собой значения переменных в первой и второй выборке, какие-то, пусть даже незначительные, различия между ними будут обнаруживаться. С точки же зрения математической статистики нас интересует вопрос, являются ли различия между этими выборками статистически достоверными (статистически значимыми) или недостоверными (случайными).

Наиболее распространенными критериями достоверности различий между выборками являются параметрические меры различий – критерий Стьюдента и критерий Фишера . В ряде случаев используются непараметрические критерии – критерий Q Розенбаума, U-критерий Манна- Уитни и др. Особое место занимает угловое преобразование Фишера φ* , позволяющие сравнивать друг с другом значения, выраженные в процентах (процентных долях). И, наконец, как частный случай, для сравнения выборок могут быть использованы критерии, характеризующие форму распределений выборок – критерий χ 2 Пирсона и критерий λ Колмогорова – Смирнова .

В целях наилучшего усвоения данной темы мы поступим следующим образом. Одну и ту же задачу мы решим четырьмя методами с использованием четырех различных критериев – Розенбаума, Манна-Уитни, Стьюдента и Фишера.

Условие задачи

30 студентов (14 юношей и 16 девушек) во время экзаменационной сессии протестированы по тесту Спилбергера на уровень реактивной тревожности. Получены следующие результаты (табл. 7.1):

Таблица 7.1

Испытуемые

Уровень реактивной тревожности

Юноши

Девушки

Задание

Определить, являются ли статистически достоверными различия уровня реактивной тревожности у юношей и девушек.

Задача представляется вполне типичной для психолога, специализирующегося в области педагогической психологии: кто более остро переживает экзаменационный стресс – юноши или девушки? Если различия между выборками статистически достоверны, то существуют значимые половые различия в данном аспекте; если различия случайны (статистически недостоверны), от данного предположения следует отказаться.

7. 2. Непараметрический критерий Q Розенбаума

Q -критерий Розенбаума основан на сравнении «наложенных» друг на друга ранжированных рядов значений двух независимых переменных. При этом не анализируется характер распределения признака внутри каждого ряда – в данном случае имеет значение лишь ширина неперекрывающихся участков двух ранжированных рядов. При сравнении между собой двух ранжированных рядов переменных возможны 3 варианта:

1. Ранжированные ряды x и y не имеют области перекрытия, т. е. все значения первого ранжированного ряда (x ) больше всех значений второго ранжированного ряда(y ):

В данном случае различия между выборками, определяемые по любому статистическому критерию, безусловно достоверны, и использование критерия Розенбаума не требуется. Тем не менее на практике такой вариант встречается исключительно редко.

2. Ранжированные ряды полностью накладываются друг на друга (как правило, один из рядов находится внутри другого), неперекрывающиеся зоны отсутствуют. В данном случае критерий Розенбаума неприменим.

3. Имеется зона перекрытия рядов, а также две неперекрывающиеся области (N 1 и N 2 ), относящиеся к разным ранжированным рядам (обозначим х – ряд, сдвинутый в сторону больших, y – в сторону меньших значений):

Данный случай является типичным для использования критерия Розенбаума, при использовании которого следует соблюдать следующие условия:

1. Объем каждой выборки должен быть не менее 11.

2. Объемы выборок не должны существенно отличаться друг от друга.

Критерий Q Розенбаума соответствует числу неперекрывающихся значений: Q = N 1 + N 2 . Вывод о достоверности различий между выборками делается в случае, если Q > Q кр. При этом значения Q кр находятся в специальных таблицах (см. Приложение, табл. VIII).

Вернемся к нашей задаче. Введем обозначения: х – выборка девушек, y – выборка юношей. Для каждой выборки строим ранжированный ряд:

х : 28 30 34 34 35 36 37 39 40 41 42 42 43 44 45 46

y : 26 28 32 32 33 34 35 38 39 40 41 42 43 44

Подсчитываем число значений в неперекрывающихся областях ранжированных рядов. В ряду х неперекрывающимися являются значения 45 и 46, т. е. N 1 = 2;в ряду y только 1 неперекрывающееся значение 26, т. е. N 2 = 1. Отсюда, Q = N 1 + N 2 = 1 + 2 = 3.

В табл. VIII Приложения находим, что Q кр . = 7 (для уровня значимости 0,95) и Q кр = 9 (для уровня значимости 0,99).

Вывод

Поскольку Q < Q кр, то по критерию Розенбаума различия между выборками не являются статистически достоверными.

Примечание

Критерий Розенбаума может использоваться независимо от характера распределения переменных, т. е. в данном случае отпадает необходимость использования критериев χ 2 Пирсона и λ Колмогорова для определения типа распределений в обеих выборках.

7. 3. U -критерий Манна – Уитни

В отличие от критерия Розенбаума, U -критерий Манна – Уитни основан на определении зоны перекрытия между двумя ранжированными рядами, т. е. чем меньше зона перекрытия, тем достовернее различия между выборками. Для этого используется специальная процедура преобразования интервальных шкал в ранговые.

Рассмотрим алгоритм вычислений по U -критерию на примере предыдущей задачи.

Таблица 7.2

x, y	R xy	R xy *	R x	R y

26 28 32 32 33 34 35 38 39 40 41 42 43 44		2,5 2,5 5,5 5,5 11,5 11,5 16,5 16,5 18,5 18,5 20,5 20,5 25,5 25,5 27,5 27,5	2,5 11,5 16,5 18,5 20,5 25,5 27,5	1 2,5 5,5 5,5 7 9 11,5 15 16,5 18,5 20,5 23 25,5 27,5
		Σ	276,5	188,5

1. Из двух независимых выборок строим единый ранжированный ряд. В данном случае значения для обеих выборок идут «вперемешку», столбец 1 (x , y ). В целях упрощения дальнейшей работы (в том числе и в компьютерном варианте) следует значения для разных выборок отмечать разным шрифтом (или разным цветом) с учетом того, что в дальнейшем мы будем их разносить по разным столбцам.

2. Преобразуем интервальную шкалу значений в порядковую (для этого переобозначаем все значения ранговыми числами от 1 до 30, столбец 2 (R xy)).

3. Вводим поправки на связанные ранги (одинаковые значения переменной обозначаются одним и тем же рангом при условии, что сумма рангов не изменяется, столбец 3 (R xy *). На этом этапе рекомендуется подсчитать суммы рангов во 2-м и 3-м столбце (если все поправки введены верно, то эти суммы должны быть равны).

4. Разносим ранговые числа в соответствии с их принадлежностью к той или иной выборке (столбцы 4 и 5 (R x и R y)).

5. Проводим вычисления по формуле:

(7.1)

где Т х – наибольшая из ранговых сумм; n x и n y , соответственно, объемы выборок. В данном случае следует иметь в виду, что если T x < T y , то обозначения x и y следует сменить на обратные.

6. Сравниваем полученное значение с табличным (см. Приложения, табл. IX).Вывод о достоверности различий между двумя выборками делается в случае, если U эксп. < U кр. .

В нашем примере U эксп. = 83,5 > U кр. = 71.

Вывод

Различия между двумя выборками по критерию Манна – Уитни не являются статистически достоверными.

Примечания

1. Критерий Манна-Уитни не имеет практически никаких ограничений; минимальные объемы сравниваемых выборок – 2 и 5 человек (см. табл. IX Приложения).

2. Аналогично критерию Розенбаума критерий Манна-Уитни может быть использован применительно к любым выборкам независимо от характера распределения.

Критерий Стьюдента

В отличие от критериев Розенбаума и Манна-Уитни критерий t Стьюдента является параметрическим, т. е. основан на определении основных статистических показателей – средних значений в каждой выборке ( и ) и их дисперсий (s 2 x и s 2 y), рассчитываемых по стандартным формулам (см. раздел 5).

Использование критерия Стьюдента предполагает соблюдение следующих условий:

1. Распределения значений для обеих выборок должны соответствовать закону нормального распределения (см. раздел 6).

2. Суммарный объем выборок должен быть не менее 30 (для β 1 = 0,95) и не менее 100 (для β 2 = 0,99).

3. Объемы двух выборок не должны существенно отличаться друг от друга (не более чем в 1,5 ÷ 2 раза).

Идея критерия Стьюдента достаточно проста. Предположим, что значения переменных в каждой из выборок распределяются по нормальному закону, т. е. мы имеем дело с двумя нормальными распределениями, отличающимися друг от друга по средним значениям и дисперсии (соответственно и , и , см. рис. 7.1).

s x s y

Рис. 7.1. Оценка различий между двумя независимыми выборками: и - средние значения выборок x и y ; s x и s y - стандартные отклонения

Нетрудно понять, что различия между двумя выборками будут тем больше, чем больше разность между средними значениями и чем меньше их дисперсии (или стандартные отклонения).

В случае независимых выборок коэффициент Стьюдента определяют по формуле:

(7.2)

где n x и n y – соответственно численность выборок x и y .

После вычисления коэффициента Стьюдента в таблице стандартных (критических) значений t (см. Приложение, табл. Х) находят величину, соответствующую числу степеней свободы n = n x + n y – 2, и сравнивают ее с рассчитанной по формуле. Если t эксп. £ t кр. , то гипотезу о достоверности различий между выборками отвергают, если же t эксп. > t кр. , то ее принимают. Другими словами, выборки достоверно отличаются друг от друга, если вычисленный по формуле коэффициент Стьюдента больше табличного значения для соответствующего уровня значимости.

В рассмотренной нами ранее задаче вычисление средних значений и дисперсий дает следующие значения: x ср. = 38,5; σ х 2 = 28,40; у ср. = 36,2; σ у 2 = 31,72.

Можно видеть, что среднее значение тревожности в группе девушек выше, чем в группе юношей. Тем не менее эти различия настолько незначительны, что вряд ли они являются статистически значимыми. Разброс значений у юношей, напротив, несколько выше, чем у девушек, но различия между дисперсиями также невелики.

Вывод

t эксп. = 1,14 < t кр. = 2,05 (β 1 = 0,95). Различия между двумя сравниваемыми выборками не являются статистически достоверными. Данный вывод вполне согласуется с таковым, полученным при использовании критериев Розенбаума и Манна-Уитни.

Другой способ определения различий между двумя выборками по критерию Стьюдента состоит в вычислении доверительного интервала стандартных отклонений. Доверительным интервалом называется среднеквадратичное (стандартное) отклонение, деленное на корень квадратный из объема выборки и умноженное на стандартное значение коэффициента Стьюдента для n – 1 степеней свободы (соответственно, и ).

Примечание

Величина = m x называется среднеквадратичной ошибкой (см. раздел 5). Следовательно, доверительный интервал есть среднеквадратичная ошибка, умноженная на коэффициент Стьюдента для данного объема выборки, где число степеней свободы ν = n – 1, и заданного уровня значимости.

Две независимые друг от друга выборки считаются достоверно различающимися, если доверительные интервалы для этих выборок не перекрываются друг с другом. В нашем случае мы имеем для первой выборки 38,5 ± 2,84, для второй 36,2 ± 3,38.

Следовательно, случайные вариации x i лежат в диапазоне 35,66 ¸ 41,34, а вариации y i – в диапазоне 32,82 ¸ 39,58. На основании этого можно констатировать, что различия между выборками x и y статистически недостоверны (диапазоны вариаций перекрываются друг с другом). При этом следует иметь в виду, что ширина зоны перекрытия в данном случае не имеет значения (важен лишь сам факт перекрытия доверительных интервалов).

Метод Стьюдента для зависимых друг от друга выборок (например, для сравнения результатов, полученных при повторном тестировании на одной и той же выборке испытуемых) используют достаточно редко, поскольку для этих целей существуют другие, более информативные статистические приемы (см. раздел 10). Тем не менее, для данной цели в первом приближении можно использовать формулу Стьюдента следующего вида:

(7.3)

Полученный результат сравнивают с табличным значением для n – 1 степеней свободы, где n – число пар значений x и y . Результаты сравнения интерпретируются точно так же, как и в случае вычисления различий между двумя независимыми выборками.

Критерий Фишера

Критерий Фишера (F ) основан на том же принципе, что и критерий Стьюдента, т. е. предполагает вычисление средних значений и дисперсий в сравниваемых выборках. Чаще всего используется при сравнении между собой неравноценных по объему (разных по численности) выборок. Критерий Фишера является несколько более жестким, чем критерий Стьюдента, а потому более предпочтителен в тех случаях, когда возникают сомнения в достоверности различий (например, если по критерию Стьюдента различия достоверны при нулевом и недостоверны при первом уровне значимости).

Формула Фишера выглядит следующим образом:

(7.4)

где и (7.5, 7.6)

В рассматриваемой нами задаче d 2 = 5,29; σ z 2 = 29,94.

Подставляем значения в формулу:

В табл. ХI Приложений находим, что для уровня значимости β 1 = 0,95 и ν = n x + n y – 2 = 28 критическое значение составляет 4,20.

Вывод

F = 1,32 < F кр. = 4,20. Различия между выборками статистически недостоверны.

Примечание

При использовании критерия Фишера должны соблюдаться те же условия, что и для критерия Стьюдента (см. подраздел 7.4). Тем не менее допускается различие в численности выборок более чем в два раза.

Таким образом, при решении одной и той же задачи четырьмя различными методами с использованием двух непараметрических и двух параметрических критериев мы пришли к однозначному выводу о том, что различия между группой девушек и группой юношей по уровню реактивной тревожности недостоверны (т. е. находятся в пределах случайных вариаций). Однако могут встретиться и такие случаи, когда сделать однозначный вывод не представляется возможным: одни критерии дают достоверные, другие – недостоверные различия. В этих случаях приоритет отдается параметрическим критериям (при условии достаточности объема выборок и нормального распределения исследуемых величин).

7. 6. Критерий j* - угловое преобразование Фишера

Критерий j*Фишера предназначен для сопоставления двух выборок по частоте встречаемости интересующего исследователя эффекта. Он оценивает достоверность различий между процентными долями двух выборок, в которых зарегистрирован интересующий нас эффект. Допускается также сравнение процентных соотношений и в пределах одной выборки.

Суть углового преобразования Фишера состоит в переводе процентных долей в величины центрального угла, который измеряется в радианах. Большей процентной доле будет соответствовать больший угол j , а меньшей доле – меньший угол, но отношения здесь нелинейные:

где Р – процентная доля, выраженная в долях единицы.

При увеличении расхождения между углами j 1 и j 2 и увеличении численности выборок значение критерия возрастает.

Критерий Фишера вычисляется по следующей формуле:

где j 1 – угол, соответствующий большей процентной доле; j 2 – угол, соответствующий меньшей процентной доле; n 1 и n 2 – соответственно, объем первой и второй выборок.

Вычисленное по формуле значение сравнивается со стандартным (j* ст = 1,64 для b 1 = 0,95 и j* ст = 2,31 для b 2 = 0,99. Различия между двумя выборками считаются статистически достоверными, если j*> j* ст для данного уровня значимости.

Пример

Нас интересует, различаются ли между собой две группы студентов по успешности выполнения достаточно сложной задачи. В первой группе из 20 человек с ней справилось 12 студентов, во второй – 10 человек из 25.

Решение

1. Вводим обозначения: n 1 = 20, n 2 = 25.

2. Вычисляем процентные доли Р 1 и Р 2: Р 1 = 12 / 20 = 0,6 (60%), Р 2 = 10 / 25 = 0,4 (40%).

3. В табл. XII Приложений находим соответствующие процентным долям значения φ: j 1 = 1,772, j 2 = 1,369.

Отсюда:

Вывод

Различия между группами не являются статистически достоверными, поскольку j* < j* ст для 1-го и тем более для 2-го уровня значимости.

7.7. Использование критерия χ2 Пирсона и критерия λ Колмогорова

Конечно, при вычислении кумулятивной функции распределения следует воспользоваться упомянутой связью биномиального и бета- распределения. Этот способ заведомо лучше непосредственного суммирования, когда n > 10.

В классических учебниках по статистике для получения значений биномиального распределения часто рекомендуют использовать формулы, основанные на предельных теоремах (типа формулы Муавра-Лапласа). Необходимо отметить, что с чисто вычислительной точки зрения ценность этих теорем близка к нулю, особенно сейчас, когда практически на каждом столе стоит мощный компьютер. Основной недостаток приведенных аппроксимаций – их совершенно недостаточная точность при значениях n, характерных для большинства приложений. Не меньшим недостатком является и отсутствие сколько-нибудь четких рекомендаций о применимости той или иной аппроксимации (в стандартных текстах приводятся лишь асимптотические формулировки, они не сопровождаются оценками точности и, следовательно, мало полезны). Я бы сказал, что обе формулы пригодны лишь при n < 200 и для совсем грубых, ориентировочных расчетов, причем делаемых “вручную” с помощью статистических таблиц. А вот связь между биномиальным распределением и бета-распределением позволяет вычислять биномиальное распределение достаточно экономно.

Я не рассматриваю здесь задачу поиска квантилей: для дискретных распределений она тривиальна, а в тех задачах, где такие распределения возникают, она, как правило, и не актуальна. Если же квантили все-таки понадобятся, рекомендую так переформулировать задачу, чтобы работать с p-значениями (наблюденными значимостями). Вот пример: при реализации некоторых переборных алгоритмов на каждом шаге требуется проверять статистическую гипотезу о биномиальной случайной величине. Согласно классическому подходу на каждом шаге нужно вычислить статистику критерия и сравнить ее значение с границей критического множества. Поскольку, однако, алгоритм переборный, приходится определять границу критического множества каждый раз заново (ведь от шага к шагу объем выборки меняется), что непроизводительно увеличивает временные затраты. Современный подход рекомендует вычислять наблюденную значимость и сравнивать ее с доверительной вероятностью, экономя на поиске квантилей.

Поэтому в приводимых ниже кодах отсутствует вычисление обратной функции, взамен приведена функция rev_binomialDF , которая вычисляет вероятность p успеха в отдельном испытании по заданному количеству n испытаний, числу m успехов в них и значению y вероятности получить эти m успехов. При этом используется вышеупомянутая связь между биномиальным и бета распределениями.

Фактически, эта функция позволяет получать границы доверительных интервалов. В самом деле, предположим, что в n биномиальных испытаниях мы получили m успехов. Как известно, левая граница двухстороннего доверительного интервала для параметра p с доверительным уровнем равна 0, если m = 0, а для является решением уравнения . Аналогично, правая граница равна 1, если m = n, а для является решением уравнения . Отсюда вытекает, что для поиска левой границы мы должны решать относительно уравнение , а для поиска правой – уравнение . Они и решаются в функциях binom_leftCI и binom_rightCI , возвращающих верхнюю и нижнюю границы двустороннего доверительного интервала соответственно.

Хочу заметить, что если не нужна совсем уж неимоверная точность, то при достаточно больших n можно воспользоваться следующей аппроксимацией [Б.Л. ван дер Варден, Математическая статистика. М: ИЛ, 1960, гл. 2, разд. 7]: , где g – квантиль нормального распределения. Ценность этой аппроксимации в том, что имеются очень простые приближения, позволяющие вычислять квантили нормального распределения (см. текст о вычислении нормального распределения и соответствующий раздел данного справочника). В моей практике (в основном, при n > 100) эта аппроксимация давала примерно 3-4 знака, чего, как правило, вполне достаточно.

Для вычислений с помощью нижеследующих кодов потребуются файлы betaDF.h , betaDF.cpp (см. раздел о бета-распределении), а также logGamma.h , logGamma.cpp (см. приложение А). Вы можете посмотреть также пример использования функций.

Файл binomialDF.h

#ifndef __BINOMIAL_H__ #include "betaDF.h" double binomialDF(double trials, double successes, double p); /* * Пусть имеется "trials" независимых наблюдений * с вероятностью "p" успеха в каждом. * Вычисляется вероятность B(successes|trials,p) того, что число * успехов заключено между 0 и "successes" (включительно). */ double rev_binomialDF(double trials, double successes, double y); /* * Пусть известна вероятность y наступления не менее m успехов * в trials испытаниях схемы Бернулли. Функция находит вероятность p * успеха в отдельном испытании. * * В вычислениях используется следующее соотношение * * 1 - p = rev_Beta(trials-successes| successes+1, y). */ double binom_leftCI(double trials, double successes, double level); /* Пусть имеется "trials" независимых наблюдений * с вероятностью "p" успеха в каждом * и количество успехов равно "successes". * Вычисляется левая граница двустороннего доверительного интервала * с уровнем значимости level. */ double binom_rightCI(double n, double successes, double level); /* Пусть имеется "trials" независимых наблюдений * с вероятностью "p" успеха в каждом * и количество успехов равно "successes". * Вычисляется правая граница двустороннего доверительного интервала * с уровнем значимости level. */ #endif /* Ends #ifndef __BINOMIAL_H__ */

Файл binomialDF.cpp

/***********************************************************/ /* Биномиальное распределение */ /***********************************************************/ #include #include #include "betaDF.h" ENTRY double binomialDF(double n, double m, double p) /* * Пусть имеется "n" независимых наблюдений * с вероятностью "p" успеха в каждом. * Вычисляется вероятность B(m|n,p) того, что число успехов заключено * между 0 и "m" (включительно), т.е. * сумму биномиальных вероятностей от 0 до m: * * m * -- (n) j n-j * > () p (1-p) * -- (j) * j=0 * * Вычисления не подразумевают тупое суммирование - используется * следующая связь с центральным бета-распределением: * * B(m|n,p) = Beta(1-p|n-m,m+1). * * Аргументы должны быть положительными, причем 0 <= p <= 1. */ { assert((n > 0) && (p >= 0) && (p <= 1)); if (m < 0) return 0; else if (m == 0) return pow(1-p, n); else if (m >= n) return 1; else return BetaDF(n-m, m+1).value(1-p); }/* binomialDF */ ENTRY double rev_binomialDF(double n, double m, double y) /* * Пусть известна вероятность y наступления не менее m успехов * в n испытаниях схемы Бернулли. Функция находит вероятность p * успеха в отдельном испытании. * * В вычислениях используется следующее соотношение * * 1 - p = rev_Beta(y|n-m,m+1). */ { assert((n > 0) && (m >= 0) && (m <= n) && (y >= 0) && (y <= 1)); return 1-BetaDF(n-m, m+1).inv(y); }/*rev_binomialDF*/ ENTRY double binom_leftCI(double n, double m, double y) /* Пусть имеется "n" независимых наблюдений * с вероятностью "p" успеха в каждом * и количество успехов равно "m". * Вычисляется левая граница двухстороннего доверительного интервала * с уровнем значимости y. */ { assert((n > 0) && (m >= 0) && (m <= n) && (y >= 0.5) && (y < 1)); return BetaDF(m, n-m+1).inv((1-y)/2); }/*binom_leftCI*/ ENTRY double binom_rightCI(double n, double m, double y) /* Пусть имеется "n" независимых наблюдений * с вероятностью "p" успеха в каждом * и количество успехов равно "m". * Вычисляется правая граница доверительного интервала * с уровнем значимости y. */ { assert((n > 0) && (m >= 0) && (m <= n) && (y >= 0.5) && (y < 1)); return BetaDF(m+1, n-m).inv((1+y)/2); }/*binom_rightCI*/

Х			…	k	…	n
Р			…		…

Пример 7.1 . Производится три независимых выстрела по мишени. Вероятность попадания при каждом выстреле равна 0,4. Случайная величина Х – число попаданий в мишень. Построить ее ряд распределения.

Решение. Возможными значениями случайной величины Х являются х 1 =0; х 2 =1; х 3 =2; х 4 =3. Найдем соответствующие вероятности, используя формулу Бернулли. Нетрудно показать, что применение этой формулы здесь вполне оправдано. Отметим, что вероятность не попадания в цель при одном выстреле будет равна 1-0,4=0,6. Получим

Ряд распределения имеет следующий вид:

Х
Р	0,216	0,432	0,288	0,064

Нетрудно проверить, что сумма всех вероятностей равна 1. Сама случайная величина Х распределена по биномиальному закону. ■

Найдем математическое ожидание и дисперсию случайной величины, распределенной по биномиальному закону.

При решении примера 6.5 было показано, что математическое ожидание числа появлений события А в n независимых испытаниях, если вероятность появления А в каждом испытании постоянна и равна р , равно n ·р

В этом примере использовалась случайная величина, распределенная по биномиальному закону. Поэтому решение примера 6.5, по сути является доказательством следующей теоремы.

Теорема 7.1. Математическое ожидание дискретной случайной величины, распределенной по биномиальному закону, равно произведению числа испытаний на вероятность "успеха", т.е. М (Х )= n ·р.

Теорема 7.2. Дисперсия дискретной случайной величины, распределенной по биномиальному закону, равна произведению числа испытаний на вероятность "успеха" и на вероятность "неудачи", т.е. D (Х )= nрq.

Асимметрия и эксцесс случайной величины, распределенной по биномиальному закону, определяются по формулам

Эти формулы можно получить, воспользовавшись понятием начальных и центральных моментов.

Биномиальный закон распределения лежит в основе многих реальных ситуаций. При больших значениях n биномиальное распределение может быть аппроксимировано с помощью других распределений, в частности с помощью распределения Пуассона.

Распределение Пуассона

Пусть имеется n испытаний Бернулли, при этом число испытаний n достаточно велико. Ранее было показано, что в этом случае (если к тому же вероятность р события А очень мала) для нахождения вероятности того, что событие А появиться т раз в испытаниях можно воспользоваться формулой Пуассона (4.9). Если случайная величина Х означает число появлений события А в n испытаниях Бернулли, то вероятность того, что Х примет значение k может быть вычислена по формуле

, (7.2)

где λ = nр .

Законом распределения Пуассона называется распределение дискретной случайной величины Х , для которой возможными значениями являются целые неотрицательные числа, а вероятности р т этих значений находятся по формуле (7.2).

Величина λ = nр называется параметром распределения Пуассона.

Случайная величина, распределенная по закону Пуассона, может принимать бесконечное множество значений. Так как для этого распределения вероятность р появления события в каждом испытании мала, то это распределение иногда называют законом редких явлений.

Ряд распределения случайной величины, распределенной по закону Пуассона, имеет вид

Х					…	т	…
Р					…		…

Нетрудно убедиться, что сумма вероятностей второй строки равна 1. Для этого необходимо вспомнить, что функцию можно разложить в ряд Маклорена, который сходится для любого х . В данном случае имеем

. (7.3)

Как было отмечено, закон Пуассона в определенных предельных случаях заменяет биномиальный закон. В качестве примера можно привести случайную величину Х , значения которой равны количеству сбоев за определенный промежуток времени при многократном применении технического устройства. При этом предполагается, что это устройство высокой надежности, т.е. вероятность сбоя при одном применении очень мала.

Кроме таких предельных случаев, на практике встречаются случайные величины, распределенные по закону Пуассона, не связанные с биномиальным распределением. Например, распределение Пуассона часто используется тогда, когда имеют дело с числом событий, появляющихся в промежутке времени (число поступлений вызовов на телефонную станцию в течение часа, число машин, прибывших на авто мойку в течение суток, число остановок станков в неделю и т.п.). Все эти события должны образовывать, так называемый поток событий, который является одним из основных понятий теории массового обслуживания. Параметр λ характеризует среднюю интенсивность потока событий.

КАТЕГОРИИ