numpy.random.f
-
numpy.random.f(dfnum, dfden, size=None) -
Извлечение выборок из распределения F.
Выборка производится из распределения F со заданными параметрами,
dfnum(степени свободы в числителе) иdfden(степени свободы в знаменателе), где оба параметра должны быть больше нуля.Случайная величина распределения F (также известного как распределение Фишера) — это непрерывное распределение вероятностей, которое возникает в тестах ANOVA, и представляет собой отношение двух случайных величин, распределённых по хи-квадрат.
Параметры: dfnum : float
Степень свободы в числителе. Должна быть больше нуля.
dfden : float
Степень свободы в знаменателе. Должна быть больше нуля.
size : int или кортеж из целых чисел, необязательно
Форма выходных данных. Если заданная форма, например,
(m, n, k), тоm * n * kвыборок будет извлечено. По умолчанию None, в этом случае возвращается единственное значение.Возвращаемое значение: samples : ndarray или скаляр
Выборка из распределения Фишера.
См. также
scipy.stats.distributions.f- функция плотности вероятности, распределение или кумулятивная функция распределения и т.д.
Примечания
Статистика F используется для сравнения внутригрупповых дисперсий с межгрупповыми дисперсиями. Вычисление распределения зависит от выборки, поэтому является функцией соответствующих степеней свободы в задаче. Переменная
dfnum— это количество выборок минус один, степень свободы между группами, аdfden— внутригрупповые степени свободы, сумма количества выборок в каждой группе минус количество групп.Список литературы
[R219] Glantz, Stanton A. «Руководство по биостатистике». McGraw-Hill, пятое издание, 2002 г. [R220] Википедия, «Распределение F», http://en.wikipedia.org/wiki/F-distribution Примеры
Пример из Glantz[1], стр. 47-40:
Две группы: дети диабетиков (25 человек) и дети из семей без диабета (25 контрольных). Было измерена концентрация глюкозы натощак, в первой группе среднее значение составляло 86,1, во второй — 82,2. Стандартные отклонения соответственно равны 2,09 и 2,49. Совместимы ли эти данные с нулевой гипотезой, что статус родителей по диабету не влияет на уровень глюкозы в крови их детей? Вычисление статистики F по данным дает значение 36,01.
Извлечение выборок из распределения:
>>> dfnum = 1. # between group degrees of freedom >>> dfden = 48. # within groups degrees of freedom >>> s = np.random.f(dfnum, dfden, 1000)
Нижняя граница для верхних 1% выборок:
>>> sort(s)[-10] 7.61988120985
Таким образом, вероятность того, что статистика F превысит 7,62, составляет около 1%. Измеренное значение 36, поэтому нулевая гипотеза отвергается на уровне значимости 1%.
© 2008–2016 NumPy Developers
Licensed under the NumPy License.
https://docs.scipy.org/doc/numpy-1.11.0/reference/generated/numpy.random.f.html