Spec-Zone.ru › NumPy 1.10

numpy.random.RandomState.f

RandomState.f(dfnum, dfden, size=None)

Выборка образцов из распределения Фишера.

Образцы выбираются из распределения Фишера со заданными параметрами, dfnum (степени свободы в числителе) и dfden (степени свободы в знаменателе), где оба параметра должны быть больше нуля.

Случайная величина распределения Фишера (также известного как распределение Фишера) является непрерывным распределением вероятностей, которое возникает в тестах ANOVA, и представляет собой отношение двух величин хи-квадрат.

Параметры:

dfnum : float

Степени свободы в числителе. Должно быть больше нуля.

dfden : float

Степени свободы в знаменателе. Должно быть больше нуля.

size : int или кортеж из целых чисел, необязательно

Форма выходных данных. Если заданная форма, например, (m, n, k), тогда m * n * k образцов выбираются. По умолчанию None, в этом случае возвращается одно значение.

Возвращаемое значение:

samples : ndarray или скаляр

Образцы из распределения Фишера.

См. также

scipy.stats.distributions.f
функция плотности вероятности, распределение или функция кумулятивной плотности и т.д.

Примечания

Статистика Фишера используется для сравнения внутригрупповых дисперсий с дисперсиями между группами. Вычисление распределения зависит от выборки, поэтому это функция соответствующих степеней свободы в задаче. Переменная dfnum представляет количество образцов минус один, степени свободы между группами, в то время как dfden представляет собой степени свободы внутри групп, сумму количества образцов в каждой группе минус количество групп.

Ссылки

[R148] Glantz, Stanton A. «Руководство по биостатистике». McGraw-Hill, пятое издание, 2002.
[R149] Википедия, «Распределение Фишера», http://en.wikipedia.org/wiki/F-distribution

Примеры

Пример из Glantz[1], стр. 47-40:

Две группы, дети диабетиков (25 человек) и дети людей без диабета (25 контрольных). Измерялся уровень глюкозы в крови натощак, у первой группы среднее значение 86,1, у контрольной группы 82,2. Стандартные отклонения соответственно 2,09 и 2,49. Совместимы ли эти данные с нулевой гипотезой о том, что статус родителей-диабетиков не влияет на уровень глюкозы в крови их детей? Вычисление статистики Фишера по данным дает значение 36,01.

Выбрать образцы из распределения:

>>> dfnum = 1. # between group degrees of freedom
>>> dfden = 48. # within groups degrees of freedom
>>> s = np.random.f(dfnum, dfden, 1000)

Нижняя граница для верхних 1% образцов:

>>> sort(s)[-10]
7.61988120985

Таким образом, вероятность того, что статистика Фишера превысит 7,62, составляет около 1%. Измеренное значение равно 36, поэтому нулевая гипотеза отвергается на уровне 1%.

© 2008–2016 NumPy Developers
Licensed under the NumPy License.
https://docs.scipy.org/doc/numpy-1.10.1/reference/generated/numpy.random.RandomState.f.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API