numpy.random.Generator.f
метод
-
Generator.f(dfnum, dfden, size=None) -
Генерирует выборку из распределения Фишера.
Выборка генерируется из распределения Фишера со заданными параметрами,
dfnum(степени свободы в числителе) иdfden(степени свободы в знаменателе), где оба параметра должны быть больше нуля.Случайная величина распределения Фишера (также известного как распределение Фишера-Снедекора) является непрерывным распределением вероятностей, которое возникает в тестах ANOVA и представляет собой отношение двух хи-квадрат величин.
- Параметры
-
-
dfnumfloat or array_like of floats -
Степень свободы в числителе, должна быть > 0.
-
dfdenfloat or array_like of float -
Степень свободы в знаменателе, должна быть > 0.
-
sizeint or tuple of ints, optional -
Форма выходных данных. Если заданная форма, например,
(m, n, k), тоm * n * kвыборок генерируется. Если размерNone(по умолчанию), то возвращается одно значение, еслиdfnumиdfden— скаляры. В противном случаеnp.broadcast(dfnum, dfden).sizeвыборок генерируется.
-
- Возвращает
-
-
outndarray or scalar -
Сгенерированные выборки из распределения Фишера.
-
См. также
-
scipy.stats.f -
функция плотности вероятности, распределение или функция кумулятивной плотности и т. д.
Примечания
Статистика Фишера используется для сравнения внутригрупповых дисперсий с межгрупповыми дисперсиями. Вычисление распределения зависит от выборки, и поэтому оно является функцией соответствующих степеней свободы в задаче. Переменная
dfnum— это количество выборок минус один, степени свободы между группами, аdfden— степени свободы внутри групп, сумма количества выборок в каждой группе минус количество групп.Ссылки
-
1 -
Гланц, Стэнтон А. «Введение в биостатистику». McGraw-Hill, пятое издание, 2002 г.
-
2 -
Википедия, «Распределение Фишера», https://en.wikipedia.org/wiki/F-distribution
Примеры
Пример из Гланца[1], стр. 47-40:
Две группы: дети диабетиков (25 человек) и дети без диабета (25 контрольных). Измерялся уровень глюкозы в плазме натощак. В группе больных диабетом среднее значение составляло 86,1, в контрольной группе — 82,2. Стандартные отклонения составляли соответственно 2,09 и 2,49. Совместимы ли эти данные с нулевой гипотезой о том, что статус родителей по диабету не влияет на уровень глюкозы в крови их детей? Вычисление статистики Фишера по данным дает значение 36,01.
Генерировать выборку из распределения:
>>> dfnum = 1. # between group degrees of freedom >>> dfden = 48. # within groups degrees of freedom >>> s = np.random.default_rng().f(dfnum, dfden, 1000)
Нижняя граница для верхних 1% выборок:
>>> np.sort(s)[-10] 7.61988120985 # random
Таким образом, существует около 1% вероятность того, что статистика Фишера превысит 7,62. Измеренное значение составляет 36, поэтому нулевая гипотеза отвергается на уровне значимости 1%.
© 2005–2020 NumPy Developers
Licensed under the 3-clause BSD License.
https://numpy.org/doc/1.19/reference/random/generated/numpy.random.Generator.f.html