Здравствуйте! 4 июня я записалась на курс Прикладная статистика. Заплатила за получение сертификата. Изучала лекции, прошла Тест 1. Сегодня вижу, что я вне курса! Почему так произошло? |
Статистический анализ числовых величин
Приведем пример двух функций распределения и таких, что гипотеза (6) выполнена, а гипотеза (2) - нет. Поскольку
( 10) |
( 11) |
Это условие выполняется, если функция является нечетной.
Пример 2. Пусть функции распределения и сосредоточены на интервале (-1; 1), на котором
Тогда
Условие (11) выполнено, поскольку функция является нечетной. Следовательно, . Начнем с вычисления
Поскольку
то .С помощью замены переменных получаем, что
В правой части последнего равенства стоят табличные интегралы (см., например, справочник [ [ 8.10 ] , с.71]). Проведя соответствующие вычисления, получаем, что в правой части стоит . Следовательно,
Перейдем к вычислению . Поскольку
тоС помощью замены переменных переходим к табличным интегралам (см., например, справочник [ [ 8.10 ] , с.65]): b^2=\frac{1}{12}+\frac{1}{4\pi}\int\limits_{-1}^1 x\sin\pi xdx+ \frac{1}{4\pi}\int\limits_{-1}^1 \sin\pi xdx+ \frca{1}{8\pi^2}\int\limits_{-1}^1 \sin^2\pi xdx.
Проведя необходимые вычисления, получим, что
Следовательно, для рассматриваемых функций распределения нормированная и центрированная статистика Вилкоксона (см. формулу (4)) асимптотически нормальна с математическим ожиданием 0 и дисперсией (см. формулу (9))
Как легко видеть, дисперсия всегда меньше 1. Это значит, что в рассматриваемом случае гипотеза полной однородности (2) при проверке с помощью критерия Вилкоксона будет приниматься чаще, чем если она на самом деле верна.
На наш взгляд, это означает, что критерий Вилкоксона нельзя считать критерием для проверки гипотезы (2) при альтернативе общего вида. Он не всегда позволяет проверить однородность - не при всех альтернативах. Точно так же критерии типа хи-квадрат нельзя считать критериями проверки гипотез согласия и однородности - они позволяют обнаружить не все различия, поскольку некоторые из них "скрадывает" группировка.
Обсудим теперь, действительно ли критерий Вилкоксона нацелен на проверку равенства медиан распределений, соответствующих выборкам.
Пример 3. Построим семейство пар функций распределения и таких, что их медианы различны, но для и выполнена гипотеза (6). Пусть распределения сосредоточены на интервале (0 ; 1), и на нем , а имеет кусочно-линейный график с вершинами в точках . Следовательно,
Очевидно, что медиана равна , а медиана равна 1/2.
Согласно соотношению (9) для выполнения гипотезы (6) достаточно определить как функцию , из условия
Вычисления дают
Учитывая, что лежит между и 1, не совпадая ни с тем, ни с другим, получаем ограничения на , а именно, Итак, построено искомое семейство пар функций распределения.
Пример 4. Пусть, как и в примере 3, распределения сосредоточены на интервале (0; 1), и на нем . А - функция распределения, сосредоточенного в двух точках - и 1. Т.е. при , не превосходящем ; на при . С такой функцией легко проводить расчеты. Однако она не удовлетворяет принятым выше условиям непрерывности и строгого возрастания. Вместе с тем легко видеть, что она является предельной (сходимость в каждой точке отрезка [0; 1]) для последовательности функций распределения, удовлетворяющих этим условиям. А распределение статистики Вилкоксона для пары функций распределения примера 4 является предельным для последовательности соответствующих распределений статистики Вилкоксона, полученных в рассматриваемых условиях непрерывности и строгого возрастания.
Условие выполнено, если (при из отрезка [0; 1/2]). Поскольку при положительном , то очевидно, что медиана равна , в то время как медиана равна 1/2 . Значит, при медианы совпадают, при всех иных положительных - различны. При медианой является любая точка из отрезка [0; 1].
Легко подсчитать, что в условиях примера 4 параметры предельного распределения имеют вид
Следовательно, распределение нормированной и центрированной статистики Вилкоксона будет асимптотически нормальным с математическим ожиданием 0 и дисперсией
Проанализируем величину в зависимости от параметра и объемов выборок и . При достаточно больших и
с точностью до величин порядка , где . Значит, - линейная функция от , а потому достигает экстремальных значений на границах интервала изменения , т.е. при и . Легко видеть, что при минимум - (при ), а максимум - (при . В случае максимум равен (при ), а минимум - (при ). Если же (это равенство справедливо при , то . при всех из отрезка [0; 1].Первый из описанных выше случаев имеет место при , при этом минимум возрастает от 0 (при - предельный случай) до (при - любом), а максимум уменьшается от 3 (при - предельный случай) до (при - любом). Второй случай относится к из интервала . При этом минимум убывает от приведенного выше значения для до 0 (при - предельный случай), а максимум возрастает от того же значения при до 3 (при ).
Таким образом, может принимать все значения из интервала (0; 3) в зависимости от значений и . Если , то при применении критерия Вилкоксона к выборкам с рассматриваемыми функциями распределения гипотеза однородности (2) будет приниматься чаще (при соответствующих значениях и - с вероятностью, сколь угодно близкой к 1), чем если бы она самом деле была верна. Если , то гипотеза (2) также принимается достаточно часто. Так, если уровень значимости критерия Вилкоксона равен 0,05, то (асимптотическая) критическая область этого критерия, как показано выше, имеет вид . Если - самый плохой случай - , то гипотеза (2) принимается с вероятностью 0,7422.
Гипотеза сдвига. При проверке гипотезы однородности мы рассмотрели различные виды нулевых и альтернативных гипотез - гипотезу (2) и ее отрицание в качестве альтернативы, гипотезу (6) и ее отрицание, гипотезы о равенстве или различии медиан. В теоретических работах по математической статистике часто рассматривают гипотезу сдвига, в которой альтернативой гипотезе (2) является гипотеза
( 12) |
В некоторых прикладных постановках гипотеза (12) представляется естественной. Например, если одним и тем же прибором проводятся две серии измерений двух значений некоторой величины (физической, химической и т.п.). При этом функция распределения описывает погрешности измерения одного значения, а - другого. Вопреки распространенному заблуждению, хорошо известно, что распределение погрешностей измерений, как правило, не является нормальным (см. об этом "Описание данных" ). Однако при анализе конкретных статистических данных, как правило, нет никаких оснований считать, что отсутствие однородности всегда выражается столь однозначным образом, как следует из формулы (12). Поэтому эконометрику для проверки однородности необходимо использовать статистические критерии, состоятельные против любого отклонения от гипотезы однородности (2).
Почему же математики так любят гипотезу сдвига (12)? Да потому, что она дает возможность доказывать глубокие математические результаты, например, об асимптотической оптимальности критериев. К сожалению, с точки зрения эконометрики это напоминает поиск ключей под фонарем, где светло, а не там, где они потеряны.
Отметим еще одно обстоятельство. Часто говорят (в соответствии с классическим подходом математической статистики), что нельзя проверять нулевые гипотезы без рассмотрения альтернативных. Однако при анализе данных технических, экономических, медицинских или иных исследований зачастую полностью ясна формулировка той гипотезы, которую желательно проверить (например, гипотезы полной однородности - см. формулу (2)), в то время как формулировка альтернативной гипотезы не очевидна (то ли это гипотеза о неверности равенства (2) хотя бы для одного значения x, то ли это альтернатива (8), то ли - альтернатива сдвига (12), и т. д.). В таких случаях целесообразно "обернуть" задачу - исходя из статистического критерия найти альтернативы, относительно которых он состоятелен. Именно это и проделано в настоящем параграфе для критерия Вилкоксона.
Подведем итоги рассмотрения критерия Вилкоксона.
- Критерий Вилкоксона (Манна-Уитни) является одним из самых распространенных непараметрических ранговых критериев, используемых для проверки однородности двух выборок. Его значение не меняется при любом монотонном преобразовании шкалы измерения (т.е. он пригоден для статистического анализа данных, измеренных в порядковой шкале).
- Распределение статистики критерия Вилкоксона определяется функциями распределения и и объемами и двух выборок. При больших объемах выборок распределение статистики Вилкоксона является асимптотически нормальным с параметрами, выписанными выше (см. формулы (1), (3) и (5)).
- При альтернативной гипотезе, когда функции распределения выборок и не совпадают, распределение статистики Вилкоксона зависит от величины . Если отличается от 1/2, то мощность критерия Вилкоксона стремится к 1, и отличает нулевую гипотезу от альтернативной. Если же , то это не всегда имеет место. В примере 2 приведены две различные функции распределения выборок и такие, что гипотеза однородности при проверке с помощью критерия Вилкоксона будет приниматься чаще, чем если она на самом деле верна.
- Следовательно, в случае общей альтернативы критерий Вилкоксона не является состоятельным, т.е. не всегда позволяет обнаружить различие функций распределения. Однако это не лишает его практической ценности, точно так же, как несостоятельность критериев типа хи-квадрат при проверке согласия, независимости или однородности не мешает отклонять нулевую гипотезу во многих практически важных случаях. Однако принятие нулевой гипотезы с помощью критерия Вилкоксона может означать не совпадение и , а лишь выполнение равенства .
- Иногда утверждают, что с помощью критерия Вилкоксона можно проверять равенство медиан функций распределения и . Это не так. В примерах 3 и 4 указаны и с , но с различными медианами. Во многих случаях это различие нельзя обнаружить с помощью критерия Вилкоксона, как это показано при численном анализе асимптотической дисперсии в примере 4.
- Указанные выше недостатки критерия Вилкоксона исчезают для специального вида альтернативы - так называемой "альтернативы сдвига" . В этом частном случае при справедливости альтернативной гипотезы мощность стремится к 1, различие медиан также всегда обнаруживается. Однако альтернатива сдвига не всегда естественна. Ее целесообразно принять, если одним и тем же прибором проводятся две серии измерений двух значений некоторой величины (физической, химической и т.п.). При этом функция распределения описывает результаты измерений с погрешностями одного значения, а - другого. Другими словами, меняется лишь измеряемое значение, а собственно распределение погрешностей - одно и то же, присущее используемому средству измерения (и обычно описанное в его техническом паспорте). Однако в большинстве статистических исследований нет никаких оснований считать, что при альтернативе функция распределения второй выборки лишь сдвигается, но не меняется каким-либо иным образом.
- При всех своих недостатках критерий Вилкоксона прост в применении и часто позволяет обнаруживать различие групп (поскольку оно часто сводится к отличию от 1/2). Приведенные здесь критические замечания не следует понимать как призыв к полному отказу от использования критерия Вилкоксона. Однако для проверки гипотезы однородности в случае альтернативы общего вида можно порекомендовать состоятельные критерии, в частности, рассматриваемые в следующем пункте критерии Смирнова и типа омега-квадрат (Лемана-Розенблатта).
- В литературе по прикладным статистическим методам соседствуют два стиля изложения. Один из них исходит из формулировок нулевой и альтернативных гипотез (или описания набора гипотез, из которого надо выбрать наиболее адекватную), для проверки которых строятся те или иные критерии. При другом стиле изложения упор делается на алгоритмическое описание критериев для проверки тех или иных гипотез, а об альтернативах даже не упоминается.
Например, в литературе по математической статистике часто говорится, что для проверки нормальности используются критерии асимметрии и эксцесса (они описаны, например, в "Проверка гипотез" и в лучшем справочнике 1960-1980-х гг. [ [ 2.1 ] , табл.4.7]). Однако они позволяют проверять некоторые соотношения между моментами распределения, но отнюдь не являются состоятельными критериями нормальности (не все отклонения от нормальности обнаруживают). Впрочем, для прикладной статистики эти критерии большого практического значения не имеют, поскольку заранее известно, что распределения конкретных технических, экономических, медицинских и иных данных скорее всего отличны от нормальных.
Так что недостатки критерия Вилкоксона не являются исключением, мощность ряда иных популярных в математической статистике критериев заслуживает тщательного изучения, при этом заранее можно сказать, что зачастую они не позволяют проверять те гипотезы, с которыми традиционно связаны. При применении подобных критериев к анализу реальных данных необходимо тщательно взвешивать их достоинства и недостатки.