numpy.random.RandomState.f
-
RandomState.f(dfnum, dfden, size=None) -
Выборка образцов из распределения Фишера.
Образцы выбираются из распределения Фишера с заданными параметрами,
dfnum(степени свободы в числителе) иdfden(степени свободы в знаменателе), где оба параметра должны быть больше нуля.Случайная величина распределения Фишера (также известного как распределение Фишера) — это непрерывное распределение вероятностей, возникающее в тестах ANOVA, и представляет собой отношение двух случайных величин с распределением хи-квадрат.
Параметры: dfnum : float или array_like из чисел с плавающей точкой
Степени свободы в числителе, должно быть > 0.
dfden : float или array_like из чисел с плавающей точкой
Степени свободы в знаменателе, должно быть > 0.
size : целое число или кортеж целых чисел, необязательно
Форма выходных данных. Если заданная форма, например,
(m, n, k), тогдаm * n * kобразцов извлекаются. Если размер равенNone(по умолчанию), возвращается одно значение, еслиdfnumиdfdenявляются скалярами. В противном случаеnp.broadcast(dfnum, dfden).sizeобразцов извлекаются.Возвращаемое значение: out : массив ndarray или скаляр
Выбранные образцы из параметризованного распределения Фишера.
См. также
-
scipy.stats.f - функция плотности вероятности, распределение или функция кумулятивного распределения и т. д.
Примечания
Статистика Фишера используется для сравнения внутригрупповых дисперсий с межгрупповыми дисперсиями. Вычисление распределения зависит от выборки, и поэтому оно является функцией соответствующих степеней свободы в задаче. Переменная
dfnum— это количество образцов минус один, степени свободы между группами, аdfden— степени свободы внутри групп, сумма количества образцов в каждой группе минус количество групп.Ссылки
[R157] Glantz, Stanton A. “Primer of Biostatistics.”, McGraw-Hill, Fifth Edition, 2002. [R158] Wikipedia, “F-distribution”, http://en.wikipedia.org/wiki/F-distribution Примеры
Пример из Glantz [1], стр. 47-40:
Две группы: дети диабетиков (25 человек) и дети из семей без диабета (25 контрольных). Измерялся уровень глюкозы в крови натощак, у первой группы среднее значение было 86,1, у контрольной — 82,2. Стандартные отклонения составляли соответственно 2,09 и 2,49. Согласуются ли эти данные с нулевой гипотезой о том, что диабетический статус родителей не влияет на уровень глюкозы в крови их детей? Вычисление статистики Фишера по данным дает значение 36,01.
Выборка образцов из распределения:
>>> dfnum = 1. # between group degrees of freedom >>> dfden = 48. # within groups degrees of freedom >>> s = np.random.f(dfnum, dfden, 1000)
Нижняя граница для верхних 1% образцов:
>>> sort(s)[-10] 7.61988120985
Таким образом, существует около 1% вероятность того, что статистика Фишера превысит 7,62. Измеренное значение равно 36, поэтому нулевая гипотеза отвергается на уровне значимости 1%.
-
© 2005–2019 NumPy Developers
Licensed under the 3-clause BSD License.
https://docs.scipy.org/doc/numpy-1.14.5/reference/generated/numpy.random.RandomState.f.html