numpy.random.zipf
-
numpy.random.zipf(a, size=None) -
Генерация выборок из распределения Цпфа.
Выборка производится из распределения Цпфа со значением параметра
a> 1.Распределение Цпфа (также известное как дзета-распределение) — это непрерывное вероятностное распределение, которое удовлетворяет закону Цпфа: частота элемента обратно пропорциональна его рангу в таблице частот.
Параметры: a : float или array_like из float
Параметр распределения. Должен быть больше 1.
size : int или кортеж из int, необязательно
Форма выходного массива. Если заданная форма, например,
(m, n, k), то генерируютсяm * n * kвыборок. Если размер равенNone(по умолчанию), возвращается одно значение, еслиa— скаляр. В противном случае, генерируютсяnp.array(a).sizeвыборок.Возвращает: out : ndarray или скаляр
Выбранные значения из распределения Цпфа с заданными параметрами.
См. также
-
scipy.stats.zipf - функция плотности вероятности, распределение или функция кумулятивного распределения и т.д.
Примечания
Плотность вероятности для распределения Цпфа:

где
— дзета-функция Римана.Названа в честь американского лингвиста Джорджа Кингсли Цпфа, который заметил, что частота любого слова в выборке языка обратно пропорциональна его рангу в таблице частот.
Ссылки
[R283] Zipf, G. K., “Selected Studies of the Principle of Relative Frequency in Language,” Cambridge, MA: Harvard Univ. Press, 1932. Примеры
Генерация выборок из распределения:
>>> a = 2. # parameter >>> s = np.random.zipf(a, 1000)
Вывод гистограммы выборок вместе с функцией плотности вероятности:
>>> import matplotlib.pyplot as plt >>> from scipy import special
Ограничение значений s до 50 для более интересного графика:
>>> count, bins, ignored = plt.hist(s[s<50], 50, normed=True) >>> x = np.arange(1., 50.) >>> y = x**(-a) / special.zetac(a) >>> plt.plot(x, y/max(y), linewidth=2, color='r') >>> plt.show()
-
© 2008–2017 NumPy Developers
Licensed under the NumPy License.
https://docs.scipy.org/doc/numpy-1.13.0/reference/generated/numpy.random.zipf.html