Участник:Riabenko/Песочница

Материал из MachineLearning.

(Различия между версиями)
Перейти к: навигация, поиск
м (Задание 1. Исследование свойств одномерных статистических критериев на модельных данных)
м (Анализ поведения схожих критериев)
Строка 112: Строка 112:
::Студент: [[критерий Колмогорова-Смирнова]] и [[критерий хи-квадрат]], <tex>p=0.25, \;\; a=0.5\,:\,0.1\,:\,5.</tex>
::Студент: [[критерий Колмогорова-Смирнова]] и [[критерий хи-квадрат]], <tex>p=0.25, \;\; a=0.5\,:\,0.1\,:\,5.</tex>
-
* <tex>x^n, \;\; x \sim p\cdot N(0,1)+ \left(1-p\right)\cdot U\left[-a,a\right], \;\; y^n, \;\; y \sim p\cdot N(0,\sigma^2)+ \left(1-p\right)\cdot U\left[-a,a\right]</tex>&nbsp;— выборки длины <tex>n</tex> из смеси нормального и равномерного <tex>U\left[-a,a\right]</tex> распределений с весами <tex>p</tex> и <tex>1-p</tex> соответственно (при генерации выборки используется случайный датчик&nbsp;— если его значение не превосходит <tex>p</tex>, то добавляем в выборку элемент, взятый из нормального распределения, иначе&nbsp;— элемент, взятый из равномерного). <br> <tex>H_0\,:</tex> дисперсии двух выборок равны, <tex>\;H_1\,:</tex> дисперсии двух выборок не равны; <br> <tex>\sigma=0.1\,:\,0.05\,:\,4, \;\; p=0.5.</tex>
+
* <tex>x^n, \;\; x \sim 0.5\cdot N(0,1)+ 0.5\cdot U\left[-a,a\right], \;\; y^n, \;\; y \sim 0.5\cdot N(0,\sigma^2)+ 0.5\cdot U\left[-a,a\right]</tex>&nbsp;— выборки длины <tex>n</tex> из смеси нормального и равномерного <tex>U\left[-a,a\right]</tex> распределений с равными весами (при генерации выборки используется случайный датчик&nbsp;— если его значение не превосходит <tex>0.5</tex>, то добавляем в выборку элемент, взятый из нормального распределения, иначе&nbsp;— элемент, взятый из равномерного). <br> <tex>H_0\,:</tex> дисперсии двух выборок равны, <tex>\;H_1\,:</tex> дисперсии двух выборок не равны; <br> <tex>\sigma=0.1\,:\,0.05\,:\,4.</tex>
::Студент: [[критерий Зигеля-Тьюки]] и [[критерий Брауна-Форсайта]], <tex> a=3, \;\; n=10\,:\,5\,:\,100.</tex>
::Студент: [[критерий Зигеля-Тьюки]] и [[критерий Брауна-Форсайта]], <tex> a=3, \;\; n=10\,:\,5\,:\,100.</tex>
::Студент: [[критерий Брауна-Форсайта]] и [[критерий О'Брайена]], <tex>a=0.5\,:\,0.1\,:\,5, \;\; n=50.</tex>
::Студент: [[критерий Брауна-Форсайта]] и [[критерий О'Брайена]], <tex>a=0.5\,:\,0.1\,:\,5, \;\; n=50.</tex>

Версия 10:12, 1 октября 2012

Содержание

Оценки

№ п/п Студент Задание 1 (1 балл) Задание 2 (1 балл) Задание 3 (3 балла) Рецензировние задания 3 (1 балл) Сумма
1 Александров Я.
2 Артюхин С.
3 Бобрик К.
4 Гаврилюк К.
5 Елшин Д.
6 Ермушева А.
7 Зимовнов А.
8 Игнатьев О.
9 Кириллов А.
10 Марченко Е.
11 Матвеева Д.
12 Меркулова Т.
13 Некрасов К.
14 Новиков П.
15 Панов А.
16 Плященко Е.
17 Полежаев В.
18 Сабурова М.
19 Соколов Е.
20 Фигурнов М.
21 Цупков С.
22 Шанин И.
  • Итоговая оценка вычисляется по формуле 0.7*HomeWork+0.3*Oral, где Oral — оценка из пяти баллов за устный экзамен, HomeWork — баллы, набранные за практические задания. Нецелые значения округляются вверх.
  • Если первое или второе задание не сдано, до экзамена студент не допускается.
  • Штраф за просрочку сдачи заданий начисляется из расчета 0.1 балла за сутки.

Задание 1. Исследование свойств одномерных статистических критериев на модельных данных

Необходимо провести исследование одного или нескольких классических критериев проверки статистических гипотез. Интерес представляет поведение достигаемого уровня значимости (p-value) как функции размера выборок и параметров распределения. В соответствии с индивидуальными параметрами задания необходимо сгенерировать одну или несколько выборок из заданного распределения, выполнить проверку гипотезы при помощи соответствующего критерия, а затем многократно повторить эту процедуру для различных значений параметров. По результатам расчётов необходимо построить требуемые в задании графики, среди которых могут быть следующие:

  1. график зависимости достигаемого уровня значимости от значений параметров при однократном проведении эксперимента;
  2. график зависимости достигаемого уровня значимости одного или двух критериев от значений параметров, усреднённого по большому количеству повторений эксперимента (например, по 1000 повторений);
  3. график с эмпирическими оценками мощности одного или двух критериев для разных значений параметров.

В качестве оценки мощности принимается доля отвержений нулевой гипотезы среди всех проверок. То есть, если эксперимент повторялся k раз для каждого набора значений параметров, и в m из k случаев гипотеза была отвергнута на некотором фиксированном уровне значимости \alpha (примем \alpha=0.05), оценкой мощности будет отношение m/k.

Необходимо сдать: выполненный в LaTex или Microsoft Word отчёт с описанием алгоритма, построенными графиками и выводами (объяснение полученных результатов моделирования, границы применимости критерия и т.д.), а также *.m-файл или R-скрипт, при запуске которого на экран выводятся графики, соответствующие имеющимся в отчёте.

Задание принимается до 23:59 14.10.

Пример задания

Исследуем чувствительность классического двухвыборочного критерия Стьюдента для проверки гипотезы однородности против альтернативы сдвига при зашумлении выборок наблюдениями, взятыми из равномерного распределения.

x^n, \;\; x \sim 0.9\cdot N(\mu_1,1)+ 0.1\cdot U\left[-5+\mu_1,5+\mu_1\right] — выборка длины n из смеси стандартного нормального N(\mu_1,1) и равномерного U\left[-5+\mu_1,5+\mu_1\right] распределений с весами 0.9 и 0.1 соответственно (при генерации выборки используется случайный датчик — если его значение не превосходит 0.9, то добавляем в выборку элемент, взятый из нормального распределения, иначе — элемент, взятый из равномерного).

y^n, \;\; y \sim 0.9\cdot N(\mu_2,1)+ 0.1\cdot U\left[-5+\mu_2,5+\mu_2\right] — аналогичная выборка.

H_0\,:\; \mathbb{E}(x)=\mathbb{E}(y), \;\; H_1\,:\; \mathbb{E}(x)\neq\mathbb{E}(y).

\mu_1=0, \;\; \mu_2=-2\,:\,0.01\,:\,2, \;\; n=15\,:\,5\,:\,200.

Заметим, что однократная генерация выборок даёт достаточно нестабильные результаты, не позволяя точно оценить границы области, где нулевая гипотеза отклоняется, поэтому и необходимо усреднение по большому числу экспериментов.

Видно, что при достаточно большой разнице между средними и большом размере выборок наличие шума не мешает уверенно отклонять гипотезу однородности. Когда, наоборот, разница между средними невелика (меньше 0.2-0.5 в зависимости от размера выборок), мощность близка к нулю, а среднее значение достигаемого уровня значимости колеблется около 0.5, что логично, так как его распределение при справедливости нулевой гипотезы равномерно на [0,1].

Чтобы оценить вклад зашумления выборок, оценим при всех значениях параметра мощность критерия и средний достигаемый уровень значимости на аналогичных выборках без шума и сравним результаты.

Видно, что наличие шума всё меньше влияет на работу критерия с ростом объёма выборок и разницы между их средними. Тем не менее, в некоторых областях изменения параметров потеря мощности из-за 10% зашумления может составлять до 20%, а средний достигаемый уровень значимости может быть выше на 0.1.

Отметим, что приведённые количественные выводы справедливы только для шума рассматриваемой структуры.

Задания

Анализ поведения схожих критериев

Требуется исследовать поведение указанной пары статистических критериев, подходящих для решения одной и той же задачи, сравнить мощность и достигаемые уровни значимости и сделать выводы о границах применимости критериев. Необходимо для каждого из критериев построить графики зависимости достигаемых уровней значимости и оценок мощностей от параметров, и показать, в каких областях изменения параметров предпочтительнее использовать тот или иной критерий. Для получения более гладких графиков рекомендуется применять оба критерия к одним и тем же выборкам, а не генерировать их отдельно для каждого критерия.

  • x^n, \;\; x \sim N(0,1),\;\;y^n, \;\; y \sim N(\mu,1);
    H_0\,: средние двух выборок равны, \;H_1\,: средние двух выборок не равны;
    \mu=-2\,:\,0.02\,:\,2;\;\; n=10\,:\,5\,:\,100.
Студент: двухвыборочный критерий Стьюдента для независимых выборок и критерий Уилкоксона-Манна-Уитни.
Студент: критерий Уилкоксона-Манна-Уитни и медианный критерий.
Студент: критерий Уилкоксона-Манна-Уитни и двухвыборочный перестановочный критерий.
  • x^n, \;\; x \sim p\cdot N(0,1)+ \left(1-p\right)\cdot U\left[-a,a\right] — выборка длины n из смеси стандартного нормального N(0,1) и равномерного U\left[-a,a\right] распределений с весами p и 1-p соответственно (при генерации выборки используется случайный датчик — если его значение не превосходит p, то добавляем в выборку элемент, взятый из нормального распределения, иначе — элемент, взятый из равномерного).
     H_0\,:\; x \sim N, \;\;\; H_1\,:\; H_0 неверна;
    n=10\,:\,5\,:\,100.
Студент: критерий Шапиро-Уилка и критерий Колмогорова-Смирнова, a=1, \;\; p=0\,:\,0.02\,:\,1
Студент: критерий омега-квадрат и критерий Шапиро-Уилка, a=2, \;\; p=0\,:\,0.02\,:\,1
Студент: критерий хи-квадрат и критерий омега-квадрат, p=0.1, \;\; a=0.5\,:\,0.1\,:\,5.
Студент: критерий Колмогорова-Смирнова и критерий хи-квадрат, p=0.25, \;\; a=0.5\,:\,0.1\,:\,5.
  • x^n, \;\; x \sim 0.5\cdot N(0,1)+ 0.5\cdot U\left[-a,a\right], \;\; y^n, \;\; y \sim 0.5\cdot N(0,\sigma^2)+ 0.5\cdot U\left[-a,a\right] — выборки длины n из смеси нормального и равномерного U\left[-a,a\right] распределений с равными весами (при генерации выборки используется случайный датчик — если его значение не превосходит 0.5, то добавляем в выборку элемент, взятый из нормального распределения, иначе — элемент, взятый из равномерного).
    H_0\,: дисперсии двух выборок равны, \;H_1\,: дисперсии двух выборок не равны;
    \sigma=0.1\,:\,0.05\,:\,4.
Студент: критерий Зигеля-Тьюки и критерий Брауна-Форсайта,  a=3, \;\; n=10\,:\,5\,:\,100.
Студент: критерий Брауна-Форсайта и критерий О'Брайена, a=0.5\,:\,0.1\,:\,5, \;\; n=50.
Студент: критерий О'Брайена и критерий Ансари-Бредли,  a=2, \;\; n=10\,:\,5\,:\,100.

Анализ устойчивости критериев к нарушению предположений

Требуется исследовать поведение указанного критерия в условиях нарушения лежащих в его основе предположений. Оценить мощность и достигаемый уровень значимости критерия при различных значениях параметров, сделать выводы об устойчивости

  • Двухвыборочный критерий Стьюдента для независимых выборок, нарушение предположения о нормальности.

x^n \sim p_1\cdot N(\mu_1,1)+ \left(1-p_1\right)\cdot U\left[-a+\mu_1,a+\mu_1\right] — выборка длины n из смеси нормального N(\mu_1,1) и равномерного U\left[-a+\mu_1,a+\mu_1\right] распределений с весами p_1 и 1-p_1 соответственно (при генерации каждой выборки используется случайный датчик — если его значение не превосходит p_1, то добавляем в выборку элемент, взятый из нормального распределения, иначе — элемент, взятый из равномерного).
y^n \sim p_2\cdot N(\mu_2,1)+ \left(1-p_2\right)\cdot U\left[-a+\mu_2,a+\mu_2\right] — аналогичная выборка.
H_0\,:\; \mu_1=\mu_2, \;\; H_1\,:\; \mu_1\neq\mu_2;
\mu_1=0; \;\; \mu_2=-2\,:\,0.01\,:\,2.

Студент: p_1=0.8, \;\; p_2=1, \;\; a=1, \;\; n=15\,:\,5\,:\,200.
Студент: p_1=0.9, \;\; p_2=1, \;\; a=5, \;\; n=15\,:\,5\,:\,200.
Студент: p_1=p_2=0.8, \;\; a=2, \;\; n=15\,:\,5\,:\,200.
Студент: p_1=p_2=0\,:\,0.01\,:\,1, \;\; a=1, \;\; n=150.
Студент: p_1=p_2=0\,:\,0.01\,:\,1, \;\; a=5, \;\; n=100.
  • Критерий Фишера для проверки равенства дисперсий, нарушение предположения о нормальности.

x^n, \;\; x \sim p_1\cdot N(0,\sigma_1^2)+ \left(1-p_1\right)\cdot U\left[-a,a\right] — выборка длины n из смеси нормального N(0,\sigma_1^2) и равномерного U[-a,a] распределений с весами p_1 и 1-p_1 соответственно (при генерации выборки используется случайный датчик — если его значение не превосходит p_1, то добавляем в выборку элемент, взятый из нормального распределения, иначе — элемент, взятый из равномерного),
y^n,\;\; y \sim p_2\cdot N(0,\sigma_2^2)+ \left(1-p_2\right)\cdot U\left[-a,a\right] — аналогичная выборка,
H_0\,:\; var(x)=var(y), \;\; H_1\,:\; var(x)\neq var(y),
\sigma_1=2, \;\; \sigma_2=0.1\,:\,0.05\,:\,4.

Студент: p_1=p_2=0.8, \;\; a=2, \;\; n=15\,:\,5\,:\,200.
Студент: p_1=p_2=0\,:\,0.01\,:\,1, \;\; a=2, \;\; n=150.
Студент: p_1=p_2=0\,:\,0.01\,:\,1, \;\; a=3, \;\; n=100.
  • Непараметрические критерии для проверки равенства дисперсий, нарушение предположения о равенстве медиан.

x^n, \;\; x \sim N(0,1), \;\; y^n, \;\; y \sim N(\mu,\sigma^2);
H_0\,:\; var(x)=var(y), \;\; H_1\,:\; var(x)\neq var(y).

Студент: критерий Зигеля-Тьюки, \mu=0\,:\,0.02\,:\,2, \;\; \sigma=0.1\,:\,0.05\,:\,2, \;\; n=50.
Студент: критерий Зигеля-Тьюки, \mu=1, \;\; \sigma=0.1\,:\,0.05\,:\,2, \;\; n=15\,:\,5\,:\,200.
Студент: критерий Ансари-Бредли, \mu=0\,:\,0.02\,:\,2, \;\; \sigma=0.1\,:\,0.05\,:\,2, \;\; n=50.
Студент: критерий Ансари-Бредли, \mu=1, \;\; \sigma=0.1\,:\,0.05\,:\,2, \;\; n=15\,:\,5\,:\,200.
Личные инструменты