Spec-Zone.ru › NumPy 1.13

numpy.random.RandomState.f

RandomState.f(dfnum, dfden, size=None)

Выборка значений из распределения Фишера.

Выборка значений производится из распределения Фишера со заданными параметрами, dfnum (степени свободы в числителе) и dfden (степени свободы в знаменателе), где оба параметра должны быть больше нуля.

Случайная величина распределения Фишера (также известного как распределение Фишера—Снедекора) — непрерывное распределение вероятностей, которое возникает в тестах ANOVA и представляет собой отношение двух хи-квадрат величин.

Параметры:

dfnum : int или array_like из int

Степень свободы в числителе. Должна быть больше нуля.

dfden : int или array_like из int

Степень свободы в знаменателе. Должна быть больше нуля.

size : int или кортеж из int, необязательно

Форма выходного массива. Если заданная форма, например, (m, n, k), то m * n * k значений выбираются. Если size не задан (по умолчанию), то возвращается одно значение, если dfnum и dfden являются скалярами. В противном случае np.broadcast(dfnum, dfden).size значений выбираются.

Возвращаемое значение:

out : ndarray или скаляр

Выбранные значения из распределения Фишера.

См. также

scipy.stats.f
плотность вероятности, распределение или кумулятивная функция распределения и т.д.

Примечания

Статистика Фишера используется для сравнения внутригрупповых дисперсий и межгрупповых дисперсий. Расчёт распределения зависит от выборки, поэтому он является функцией соответствующих степеней свободы в задаче. Переменная dfnum представляет собой число выборок минус один, степень свободы между группами, а dfden — степень свободы внутри групп, сумму числа выборок в каждой группе минус число групп.

Ссылки

[R153] Glantz, Stanton A. “Primer of Biostatistics.”, McGraw-Hill, Fifth Edition, 2002.
[R154] Wikipedia, “F-distribution”, http://en.wikipedia.org/wiki/F-distribution

Примеры

Пример из Glantz[1], стр. 47-40:

Две группы: дети диабетиков (25 человек) и дети людей без диабета (25 контрольных). Измерялся уровень глюкозы в плазме натощак, у первой группы среднее значение составило 86,1, у контрольной — 82,2. Стандартные отклонения составили соответственно 2,09 и 2,49. Совместимы ли эти данные с нулевой гипотезой, что статус диабета родителей не влияет на уровень глюкозы в крови их детей? Вычисление статистики Фишера по данным даёт значение 36,01.

Генерация выборок из распределения:

>>> dfnum = 1. # between group degrees of freedom
>>> dfden = 48. # within groups degrees of freedom
>>> s = np.random.f(dfnum, dfden, 1000)

Нижняя граница для верхних 1% выборок:

>>> sort(s)[-10]
7.61988120985

Таким образом, вероятность того, что статистика Фишера превысит 7,62, составляет около 1%. Измеренное значение равно 36, поэтому нулевая гипотеза отвергается на уровне значимости 1%.

© 2008–2017 NumPy Developers
Licensed under the NumPy License.
https://docs.scipy.org/doc/numpy-1.13.0/reference/generated/numpy.random.RandomState.f.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API