numpy.random.Generator.f
метод
- random.Generator.f(dfnum, dfden, size=None)
-
Выборка значений из распределения Фишера.
Значения выбираются из распределения Фишера со заданными параметрами,
dfnum(степени свободы в числителе) иdfden(степени свободы в знаменателе), где оба параметра должны быть больше нуля.Случайная величина распределения Фишера (также известного как распределение Фишера) — это непрерывное распределение вероятностей, возникающее в тестах ANOVA, и представляет собой отношение двух величин хи-квадрат.
- Параметры
-
- dfnumfloat или array_like чисел с плавающей точкой
-
Степень свободы в числителе, должна быть > 0.
- dfdenfloat или array_like чисел с плавающей точкой
-
Степень свободы в знаменателе, должна быть > 0.
- sizeцелое число или кортеж целых чисел, необязательно
-
Форма выходных данных. Если заданная форма, например,
(m, n, k), тоm * n * kзначений выбираются. Если размер равенNone(по умолчанию), возвращается одно значение, еслиdfnumиdfdenявляются скалярами. В противном случаеnp.broadcast(dfnum, dfden).sizeзначений выбираются.
- Возвращаемое значение
-
- outndarray или скаляр
-
Выбранные значения из распределения Фишера.
См. также
scipy.stats.f-
функция плотности вероятности, распределение или функция кумулятивного распределения и т.д.
Примечания
Статистика Фишера используется для сравнения дисперсий внутри групп с дисперсиями между группами. Вычисление распределения зависит от выборки, поэтому оно является функцией соответствующих степеней свободы в задаче. Переменная
dfnum— это количество выборок минус один, степень свободы между группами, аdfden— степень свободы внутри групп, сумма количества выборок в каждой группе минус количество групп.Ссылки
- 1
-
Glantz, Stanton A. «Primer of Biostatistics.» , McGraw-Hill, Пятое издание, 2002.
- 2
-
Wikipedia, «F-распределение», https://en.wikipedia.org/wiki/F-distribution
Примеры
Пример из Glantz [1], стр. 47-40:
Две группы: дети диабетиков (25 человек) и дети от людей без диабета (25 контрольных). Измерялся уровень глюкозы в плазме натощак, у первой группы среднее значение было 86,1, у контрольной группы — 82,2. Стандартные отклонения составляли соответственно 2,09 и 2,49. Совместимы ли эти данные с нулевой гипотезой о том, что состояние родителей с диабетом не влияет на уровень глюкозы в крови у их детей? Вычисление статистики Фишера по данным дает значение 36,01.
Выборка значений из распределения:
>>> dfnum = 1. # between group degrees of freedom >>> dfden = 48. # within groups degrees of freedom >>> s = np.random.default_rng().f(dfnum, dfden, 1000)
Нижняя граница для 1% самых больших значений:
>>> np.sort(s)[-10] 7.61988120985 # random
Таким образом, существует около 1% вероятность того, что статистика Фишера превысит 7,62. Измеренное значение равно 36, поэтому нулевая гипотеза отвергается на уровне значимости 1%.
© 2005–2022 NumPy Developers
Licensed under the 3-clause BSD License.
https://numpy.org/doc/1.21/reference/random/generated/numpy.random.Generator.f.html