Spec-Zone.ru › NumPy 1.15

numpy.random.RandomState.f

RandomState.f(dfnum, dfden, size=None)

Выборка значений из распределения Фишера.

Значения выбираются из распределения Фишера со заданными параметрами, dfnum (степени свободы в числителе) и dfden (степени свободы в знаменателе), где оба параметра должны быть больше нуля.

Случайная величина распределения Фишера (также известного как распределение Фишера — Снедекора) — это непрерывное вероятностное распределение, возникающее при проверке гипотез в дисперсионном анализе, и представляет собой отношение двух хи-квадрат величин.

Параметры:
dfnum : float or array_like of floats

Степени свободы в числителе, должно быть > 0.

dfden : float or array_like of float

Степени свободы в знаменателе, должно быть > 0.

size : int or tuple of ints, optional

Форма выходных данных. Если заданная форма, например, (m, n, k), то m * n * k значений выбирается. Если размерность None (по умолчанию), то возвращается единственное значение, если dfnum и dfden — скаляры. В противном случае, np.broadcast(dfnum, dfden).size значений выбирается.

Возвращает:
out : ndarray or scalar

Выбранные значения из распределения Фишера.

См. также

scipy.stats.f
функция плотности вероятности, распределение или функция кумулятивного распределения и т.д.

Примечания

Статистика Фишера используется для сравнения внутригрупповых дисперсий с межгрупповыми дисперсиями. Вычисление распределения зависит от выборки, и поэтому является функцией соответствующих степеней свободы в задаче. Переменная dfnum — это количество выборок минус один, степени свободы между группами, а dfden — степени свободы внутри групп, сумма количества выборок в каждой группе минус количество групп.

Ссылки

[1] Glantz, Stanton A. “Primer of Biostatistics.”, McGraw-Hill, Fifth Edition, 2002.
[2] Wikipedia, “F-distribution”, http://en.wikipedia.org/wiki/F-distribution

Примеры

Пример из Glantz[1], стр. 47-40:

Две группы: дети диабетиков (25 человек) и дети без диабета (25 контрольных). Измерялся уровень глюкозы в плазме натощак, у группы больных среднее значение было 86,1, у контрольной — 82,2. Стандартные отклонения составляли 2,09 и 2,49 соответственно. Совместимы ли эти данные с нулевой гипотезой о том, что состояние диабета у родителей не влияет на уровень глюкозы в крови у детей? Вычисление статистики Фишера по данным дает значение 36,01.

Выборка значений из распределения:

>>> dfnum = 1. # between group degrees of freedom
>>> dfden = 48. # within groups degrees of freedom
>>> s = np.random.f(dfnum, dfden, 1000)

Нижняя граница для 1% верхних значений:

>>> sort(s)[-10]
7.61988120985

Таким образом, существует примерно 1% вероятность, что статистика Фишера превысит 7,62, измеренное значение равно 36, поэтому нулевая гипотеза отвергается на уровне 1%.

© 2005–2019 NumPy Developers
Licensed under the 3-clause BSD License.
https://docs.scipy.org/doc/numpy-1.15.4/reference/generated/numpy.random.RandomState.f.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API